Сегодня 20 ноября 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → rdr2

GPT-4 освоил Red Dead Redemption 2, но его подводит машинное зрение

Группа исследователей из Китая и Сингапура научила ИИ на базе OpenAI GPT-4V играть в Red Dead Redemption 2 (RDR2). В своей статье они рассказали о концепции общего компьютерного контроля (General Computer Control, GCC) для ИИ, и о мультимодальном агенте CRADLE — интерфейсе между GPT-4V и RDR2. По их мнению, основные проблемы у игрового ИИ-агента возникли при использовании машинного зрения.

 Источник изображения: Rockstar

Источник изображения: Rockstar

Исследователи поставили своей целью заставить ИИ, работающий на базе OpenAI GPT-4V, взаимодействовать с компьютером, воспринимая визуальные и звуковые сигналы, как это делает среднестатистический человек-пользователь ПК. Проект даёт представление о том, насколько далеко продвинулись разработчики ИИ в движении в сторону создания общего (сильного) искусственного интеллекта (AGI).

Исследователи выбрали RDR2, так как она имеет «сложную систему управления черным ящиком, которая воплощает в себе самые требовательные компьютерные задачи и позволяет нам оценить границы производительности нашей платформы в таких виртуальных средах». Кроме того, такие элементы пользовательского интерфейса, как диалоги, уникальные значки, внутриигровые подсказки и инструкции, гарантируют, что никакие базовые знания не воспринимаются как нечто само собой разумеющееся, что отлично подходит для обучения ИИ. Исследователи утверждают, что управление игрой с помощью мыши и клавиатуры обеспечивает лучшую тренировку для GCC.

 Как устроен CRADLE / Источник изображения: arxiv.org

Как устроен CRADLE / Источник изображения: arxiv.org

Исследователи стремились продемонстрировать способность ИИ изучать игру с нуля (без доступа к какому-либо внутреннему состоянию игры или API), то есть как это делает человек. ИИ-агент «проходил» игру, перемещаясь по миру и выполняя задания, следуя основной сюжетной линии RDR2. В целом, CRADLE добился заметного успеха в RDR2. Он смог «последовательно выполнять все задачи основной сюжетной линии», за исключением миссии с ураганной перестрелкой, заданий, которые требуют исследования сложного внутреннего мира, и многоэтапных миссий с открытым финалом.

 Как CRADLE выполняет buhjdst задания / Источник изображения: arxiv.org

Как CRADLE выполняет игровые задания / Источник изображения: arxiv.org

Исследователи считают, что причиной некоторых повторяющихся трудностей, с которыми сталкивался CRADLE, является GPT4-V. По их мнению, «возможности пространственно-визуального распознавания GPT-4V недостаточны для точного детального контроля». GPT4-V не справился с концепциями, специфичными для предметной области, такими как уникальные значки в игре, с пониманием мини-карт, а также с общими препятствиями в игровой среде.

 Производительность CRADLE в разных типах миссий / Источник изображения: arxiv.org

Производительность CRADLE в разных типах миссий / Источник изображения: arxiv.org

Хотя опубликованная статья посвящена взаимодействию ИИ с RDR2, авторы утверждают, что предназначение системы CRADLE в рамках GCC гораздо шире: «для поддержки более широкого спектра игр, таких как игры-симуляторы и стратегии, а также различных программных приложений».


window-new
Soft
Hard
Тренды 🔥
Google научила Gemini запоминать личную информацию о пользователе — для его же удобства 9 ч.
Первый полноценный трейлер фильма «Minecraft в кино» приятно удивил фанатов 10 ч.
Поговорить с ChatGPT теперь можно в веб-версии сервиса — там появился голосовой интерфейс Advanced Voice Mode 10 ч.
Android 16 стала доступна первым тестировщикам и разработчикам 11 ч.
Black Myth: Wukong стала самым низкооценённым претендентом на «Игру года» в истории The Game Awards 11 ч.
Google Lens облегчит офлайн-шопинг — сервис научился искать цены на товары и искать выгодные предложения 14 ч.
На панели задач Windows 11 появятся контакты, файлы и календарь из Microsoft 365 14 ч.
США будут судить российского хакера за вымогательство миллионов долларов с помощью вируса Phobos 14 ч.
Рекордный урожай: запуск Farming Simulator 25 стал лучшим в истории серии 15 ч.
Windows получила новый режим восстановления и другие функции, которые не допустят повторения сбоя CrowdStrike 15 ч.
Ким Кардашьян лично протестировала робота Optimus и беспилотное такси Tesla Cybercab 4 ч.
Основатель Moore Threads Technology верит, что в Китае можно наладить выпуск современных GPU в условиях санкций 4 ч.
iPhone 16 Pro покоряет космос в новой рекламе Apple, демонстрируя мощь чипа A18 Pro 5 ч.
Qualcomm к 2029 году хочет увеличить выручку в сегменте ПК на $4 млрд в год 5 ч.
Новая статья: Обзор видеокарты Predator BiFrost Radeon RX 7800 XT OC: строгий дизайн, тихая работа 9 ч.
Microsoft представила кастомные чипы Azure Boost DPU и Integrated HSM, уникальный AMD EPYC 9V64H с HBM и собственный вариант NVIDIA GB200 NVL72 9 ч.
Новая статья: Обзор и тестирование ноутбука Digma Pro Pactos 14”: недорого, но и не очень сердито 11 ч.
HPE обновила HPC-портфолио: узлы Cray EX, СХД E2000, ИИ-серверы ProLiant XD и 400G-интерконнект Slingshot 11 ч.
Биткоин пробил $94 000 и обновил исторический максимум — на этот раз Трамп ни при чём 12 ч.
Рынок ПК вернулся к росту — поставки клиентских CPU подскочили на 12 % в третьем квартале 13 ч.