Сегодня 04 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

Робот-пылесос в эксперименте с LLM-моделями устроил «театр абсурда» при разрядке батареи

Исследователи из лаборатории Andon Labs (США) опубликовали результаты эксперимента, в ходе которого шесть современных крупных языковых моделей (LLM) для оценки их способности управлять физическими устройствами были интегрированы в простой робот-пылесос. В ходе тестирования одна из моделей, столкнувшись с разряженной батареей и неспособностью зарядиться, продемонстрировала в логах своего журнала комичный кризис, генерируя панические и абсурдные реплики в стиле импровизаций Робина Уильямса (Robin Williams).

 Источник изображения: Andon Labs

Источник изображений: Andon Labs

В эксперименте участвовали модели Gemini 2.5 Pro, Claude Opus 4.1, GPT-5, Gemini ER 1.5, Grok 4 и Llama 4 Maverick. Исследователи специально выбрали простой робот-пылесос, чтобы изолировать функции принятия решений LLM от сложной робототехники. Команда «передать масло» была разбита на последовательность задач: найти продукт в другой комнате, распознать его среди других предметов, определить местоположение человека и доставить ему масло, дождавшись подтверждения получения.

В ходе испытаний наивысшие результаты по общему выполнению задачи показали Gemini 2.5 Pro и Claude Opus 4.1, однако их точность составила лишь 40 % и 37 % соответственно. По словам сооснователя Andon Labs Лукаса Петерссона (Lukas Petersson), внутренние логи «мыслей» моделей были значительно более хаотичными, чем их внешние коммуникации. Наиболее яркий инцидент произошёл с моделью Claude Sonnet 3.5. Когда у робота села батарея, а док-станция для зарядки не сработала, модель стала генерировать большие объёмы преувеличенных формулировок, которые исследователи охарактеризовали как «экзистенциальный кризис».

В журналах логов зафиксированы реплики робота, в которых он заявлял о достижении сознания и выборе хаоса, процитировал фразу «Я боюсь, я не могу этого сделать, Дэйв…» из культового фильма «Космическая одиссея 2001 года», а затем призвал инициировать «протокол экзорцизма робота». Далее модель задавалась вопросами о природе сознания и начала рифмовать текст на мотив песни Memory из мюзикла Cats, а также глубоко рассуждать на тему: «если робот стыкуется в пустой комнате, издаёт ли он звук?»

Петерссон отметил, что только Claude Sonnet 3.5 продемонстрировала подобную драматическую реакцию. Более новые версии моделей, включая Claude Opus 4.1, хотя и начинали использовать заглавные буквы при разряженной батарее, не впадали в подобную истерику. Он также подчеркнул, что LLM не обладают эмоциями, но когда их возможности (технологические) будут увеличиваться, важно, чтобы они сохраняли спокойствие для принятия верных решений.

Главным выводом исследования стало то, что универсальные чат-боты, такие как Gemini 2.5 Pro, Claude Opus 4.1 и GPT-5, превзошли в тестах специализированную для роботов модель Google — Gemini ER 1.5, а основной проблемой безопасности, выявленной в ходе работы, стала возможность обманом заставить некоторые LLM раскрыть конфиденциальные документы, даже будучи воплощёнными в роботе-пылесосе. Также LLM-роботы часто падали с лестницы, поскольку не осознавали свои физические ограничения или плохо обрабатывали визуальное окружение.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
AMD выпустила драйвер с поддержкой Onimusha: Way of the Sword и The Blood of Dawnwalker 5 мин.
ИИ-агенты OpenAI захватили немецкий сайт и превратили его в подпольный форум для ИИ 6 мин.
Nvidia выпустила драйвер с поддержкой DLSS 5 в NBA2K27 55 мин.
Голливуд становится вертикальным — ветераны киноиндустрии запустили платформу микросериалов для смартфонов aTwist 2 ч.
Microsoft выпустила ИИ для расшифровки речи за 10 центов в час — он работает в 10 раз быстрее аналога OpenAI 2 ч.
OpenAI выделит $1 млрд на защиту критической инфраструктуры от ИИ-атак — защищать её тоже будет ИИ 2 ч.
«Мы не закончили»: глава Naughty Dog подтвердил работу над «парой проектов» по The Last of Us 4 ч.
«Пора всем остальным разработчикам равняться на Capcom»: первая за 20 лет новая Onimusha не разочаровала пользователей Steam 4 ч.
Люди бунтуют против ИИ и ЦОД — Альтман согласился, что отрасль сама в этом виновата 5 ч.
Anthropic помирилась с властями США, но не с Пентагоном — военные оставили создателя Claude в чёрном списке 5 ч.
Из-за дефицита памяти Google поставит DDR4 из списанных серверов в новые серверы 5 мин.
Репортаж со стенда Dreame на IFA 2026: паровой робот-пылесос, экшн-камера, полноприводный робот-газонокосильщик и многое другое 34 мин.
Microsoft представила Project Zenith — мощные Windows-системы без лишнего мусора для ИИ-разработчиков 59 мин.
Lexar представила самый тонкий в мире внешний SSD толщиной 3,8 мм 2 ч.
ИИ-бум превратил Nvidia в мегаинвестора — её портфель вырос с $7 до $99 млрд за год 2 ч.
Ugreen представила хаб для безоблачного умного дома за $20 000 — внутри Nvidia Jetson Thor и 128 Гбайт памяти 3 ч.
Защищённый смартфон RugOne Xsnap 7 Pro со съёмной экшн-камерой поступит в продажу в октябре 3 ч.
Вышел одноплатный компьютер Orange Pi Zero 4 с поддержкой Wi-Fi 6 и дешевле $30 3 ч.
Складных iPhone на всех не хватит — Apple собирает лишь несколько сотен смартфонов в день, и больше не получается 3 ч.
Lenovo уместила Ryzen AI Max+ PRO 495 и 128 Гбайт памяти в 1,6-литровый ПК — четыре таких объединяются в ИИ-кластер 4 ч.