Сегодня 12 февраля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → rdr2

GPT-4 освоил Red Dead Redemption 2, но его подводит машинное зрение

Группа исследователей из Китая и Сингапура научила ИИ на базе OpenAI GPT-4V играть в Red Dead Redemption 2 (RDR2). В своей статье они рассказали о концепции общего компьютерного контроля (General Computer Control, GCC) для ИИ, и о мультимодальном агенте CRADLE — интерфейсе между GPT-4V и RDR2. По их мнению, основные проблемы у игрового ИИ-агента возникли при использовании машинного зрения.

 Источник изображения: Rockstar

Источник изображения: Rockstar

Исследователи поставили своей целью заставить ИИ, работающий на базе OpenAI GPT-4V, взаимодействовать с компьютером, воспринимая визуальные и звуковые сигналы, как это делает среднестатистический человек-пользователь ПК. Проект даёт представление о том, насколько далеко продвинулись разработчики ИИ в движении в сторону создания общего (сильного) искусственного интеллекта (AGI).

Исследователи выбрали RDR2, так как она имеет «сложную систему управления черным ящиком, которая воплощает в себе самые требовательные компьютерные задачи и позволяет нам оценить границы производительности нашей платформы в таких виртуальных средах». Кроме того, такие элементы пользовательского интерфейса, как диалоги, уникальные значки, внутриигровые подсказки и инструкции, гарантируют, что никакие базовые знания не воспринимаются как нечто само собой разумеющееся, что отлично подходит для обучения ИИ. Исследователи утверждают, что управление игрой с помощью мыши и клавиатуры обеспечивает лучшую тренировку для GCC.

 Как устроен CRADLE / Источник изображения: arxiv.org

Как устроен CRADLE / Источник изображения: arxiv.org

Исследователи стремились продемонстрировать способность ИИ изучать игру с нуля (без доступа к какому-либо внутреннему состоянию игры или API), то есть как это делает человек. ИИ-агент «проходил» игру, перемещаясь по миру и выполняя задания, следуя основной сюжетной линии RDR2. В целом, CRADLE добился заметного успеха в RDR2. Он смог «последовательно выполнять все задачи основной сюжетной линии», за исключением миссии с ураганной перестрелкой, заданий, которые требуют исследования сложного внутреннего мира, и многоэтапных миссий с открытым финалом.

 Как CRADLE выполняет buhjdst задания / Источник изображения: arxiv.org

Как CRADLE выполняет игровые задания / Источник изображения: arxiv.org

Исследователи считают, что причиной некоторых повторяющихся трудностей, с которыми сталкивался CRADLE, является GPT4-V. По их мнению, «возможности пространственно-визуального распознавания GPT-4V недостаточны для точного детального контроля». GPT4-V не справился с концепциями, специфичными для предметной области, такими как уникальные значки в игре, с пониманием мини-карт, а также с общими препятствиями в игровой среде.

 Производительность CRADLE в разных типах миссий / Источник изображения: arxiv.org

Производительность CRADLE в разных типах миссий / Источник изображения: arxiv.org

Хотя опубликованная статья посвящена взаимодействию ИИ с RDR2, авторы утверждают, что предназначение системы CRADLE в рамках GCC гораздо шире: «для поддержки более широкого спектра игр, таких как игры-симуляторы и стратегии, а также различных программных приложений».


window-new
Soft
Hard
Тренды 🔥
Microsoft залатала дыру в «Блокноте», через которую можно было запускать в Windows 11 вредоносный код 6 ч.
Apple выпустила обновления для старых версий iOS, macOS и iPadOS 6 ч.
Apple выпустила iOS 26.3 — с переносом данных на Android «по воздуху», новой галереей и другими улучшениями 6 ч.
Новая статья: Рынок кибербезопасности в России: ожидания и перспективы развития в 2026 году 7 ч.
Microsoft исправила баг Windows 11, из-за которого ПК самопроизвольно просыпались и разряжались 8 ч.
AMD выпустила драйвер с поддержкой Yakuza Kiwami 3 и Nioh 3 8 ч.
Олдскульный шутер Starship Troopers: Ultimate Bug War от создателей Warhammer 40,000: Boltgun получил дату выхода и демоверсию в Steam 10 ч.
В Steam вышла демоверсия киберпанкового боевика Replaced — первые игроки в восторге 11 ч.
T-Mobile запустит ИИ-перевод телефонных звонков в реальном времени на полсотни языков — без дополнительных приложений 11 ч.
Китайская Zhipu готовит ИИ-модель, которая сможет потягаться с DeepSeek 12 ч.
Илон Маск собирается строить спутники для инфраструктуры ИИ на Луне и запускать их с помощью огромной катапульты 2 ч.
Honor представила X6d — переиздание Play 60A с новой камерой и старым железом 9 ч.
HP теперь предлагает игровые ноутбуки по подписке — от $50 в месяц, но без права выкупа 10 ч.
Шестьдесят лет назад «Луна-9» первой в истории мягко села на Луну — теперь учёные ищут её заново 11 ч.
Ноль сопротивления и в 10 раз компактнее: Microsoft готовит сверхпроводниковую революцию для дата-центров 11 ч.
Память душит рынок: выпуск смартфонов в 2026 году может рухнуть на 10–15 % 11 ч.
Sony выпустит последние Blu-ray-рекордеры в этом месяце — но выпуск Blu-ray-плееров пока продолжится 11 ч.
Канадцы собрали «копеечный» аналог квантового компьютера для решения задач оптимизации 13 ч.
Microsoft изучает использование сверхпроводников для питания ЦОД 14 ч.
All-Flash СХД IBM FlashSystem 5600, 7600 и 9600 получили автономное ИИ-управление 14 ч.