Сегодня 19 августа 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → rdr2

GPT-4 освоил Red Dead Redemption 2, но его подводит машинное зрение

Группа исследователей из Китая и Сингапура научила ИИ на базе OpenAI GPT-4V играть в Red Dead Redemption 2 (RDR2). В своей статье они рассказали о концепции общего компьютерного контроля (General Computer Control, GCC) для ИИ, и о мультимодальном агенте CRADLE — интерфейсе между GPT-4V и RDR2. По их мнению, основные проблемы у игрового ИИ-агента возникли при использовании машинного зрения.

 Источник изображения: Rockstar

Источник изображения: Rockstar

Исследователи поставили своей целью заставить ИИ, работающий на базе OpenAI GPT-4V, взаимодействовать с компьютером, воспринимая визуальные и звуковые сигналы, как это делает среднестатистический человек-пользователь ПК. Проект даёт представление о том, насколько далеко продвинулись разработчики ИИ в движении в сторону создания общего (сильного) искусственного интеллекта (AGI).

Исследователи выбрали RDR2, так как она имеет «сложную систему управления черным ящиком, которая воплощает в себе самые требовательные компьютерные задачи и позволяет нам оценить границы производительности нашей платформы в таких виртуальных средах». Кроме того, такие элементы пользовательского интерфейса, как диалоги, уникальные значки, внутриигровые подсказки и инструкции, гарантируют, что никакие базовые знания не воспринимаются как нечто само собой разумеющееся, что отлично подходит для обучения ИИ. Исследователи утверждают, что управление игрой с помощью мыши и клавиатуры обеспечивает лучшую тренировку для GCC.

 Как устроен CRADLE / Источник изображения: arxiv.org

Как устроен CRADLE / Источник изображения: arxiv.org

Исследователи стремились продемонстрировать способность ИИ изучать игру с нуля (без доступа к какому-либо внутреннему состоянию игры или API), то есть как это делает человек. ИИ-агент «проходил» игру, перемещаясь по миру и выполняя задания, следуя основной сюжетной линии RDR2. В целом, CRADLE добился заметного успеха в RDR2. Он смог «последовательно выполнять все задачи основной сюжетной линии», за исключением миссии с ураганной перестрелкой, заданий, которые требуют исследования сложного внутреннего мира, и многоэтапных миссий с открытым финалом.

 Как CRADLE выполняет buhjdst задания / Источник изображения: arxiv.org

Как CRADLE выполняет игровые задания / Источник изображения: arxiv.org

Исследователи считают, что причиной некоторых повторяющихся трудностей, с которыми сталкивался CRADLE, является GPT4-V. По их мнению, «возможности пространственно-визуального распознавания GPT-4V недостаточны для точного детального контроля». GPT4-V не справился с концепциями, специфичными для предметной области, такими как уникальные значки в игре, с пониманием мини-карт, а также с общими препятствиями в игровой среде.

 Производительность CRADLE в разных типах миссий / Источник изображения: arxiv.org

Производительность CRADLE в разных типах миссий / Источник изображения: arxiv.org

Хотя опубликованная статья посвящена взаимодействию ИИ с RDR2, авторы утверждают, что предназначение системы CRADLE в рамках GCC гораздо шире: «для поддержки более широкого спектра игр, таких как игры-симуляторы и стратегии, а также различных программных приложений».


window-new
Soft
Hard
Тренды 🔥
Caves of Qud заслужила престижную премию «Хьюго» — это культовый ролевой роглайк в мире далёкого будущего и глубокой симуляции 11 мин.
Valve изменила, как рассчитывается пользовательский рейтинг игр в Steam — оценки теперь зависят от языка 2 ч.
Великобритания передумала требовать от Apple бэкдор в iCloud для спецслужб 3 ч.
В ChatGPT появилась подписка дешевле $5 в месяц, но пока лишь в одной стране 3 ч.
«Выглядит лучше, чем Black Myth Wukong»: новый геймплей Phantom Blade Zero с трассировкой лучей впечатлил игроков 3 ч.
Nvidia доложила об успехах технологий ACE для генеративных ИИ-NPC и RTX Remix для ремастеров классических игр 3 ч.
Число угонов Telegram-аккаунтов взлетело на 51 % в первом полугодии 4 ч.
Хакеры, шпионы и кибербезопасники теперь во всю используют ИИ, но человека он пока не заменит 5 ч.
ИИ-бот Gemini научился озвучивать тексты из «Google Документов» 7 ч.
Ведущий Gamescom: Opening Night Live заинтриговал игроков клоунским образом — фанаты увидели в этом тизер Hollow Knight: Silksong 16 ч.
Электролёт Archer Aviation с пилотом на борту впервые пролетел 88 км за 31 минуту 4 мин.
Отечественный спутниковый интернет стал на шаг ближе — российские спутниковые операторы поделили частоты 12 мин.
Fujifilm второй раз за месяц поднимет цены на камеры и объективы в США 21 мин.
Tesla вернула рычаг указателя поворотов в Model 3 — в уже проданные электромобили его установят за $350 22 мин.
В России начались продажи Honor Pаd Х7 — компактного планшета со Snapdragon 680 и ценой от 10 990 рублей 24 мин.
Американские дата-центры Google подключат к малым модульным реакторам Kairos — начнут с 50 МВт 26 мин.
Xiaomi ворвалась в топ-10 автопроизводителей мира, но на смартфонах пока зарабатывает больше 30 мин.
Видеокарты GeForce RTX 5000 официально подешевели — но не все и только в Европе 2 ч.
Складной смартфон Honor Magic V5 поднял целый холодильник, установив рекорд Гиннесса 2 ч.
Такого никто не предвидел: учёные впервые обнаружили систему из трёх чёрных дыр 2 ч.