Сегодня 08 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

Google создала и показала в деле ИИ, который заставляет роботов сначала думать, а потом делать

Компания Google DeepMind представила две новые модели искусственного интеллекта (ИИ) для робототехники Gemini Robotics 1.5 и Gemini Robotics-ER 1.5, которые совместно реализуют подход, при котором робот сначала «обдумывает» задачу и только потом выполняет действие. Технология основана на генеративных ИИ-системах и призвана преодолеть ограничения современных роботов, требующих длительной настройки под каждую конкретную задачу.

 Источник изображения: Google

Источник изображения: Google

Генеративные ИИ-системы, способные создавать текст, изображения, аудио и даже видео, становятся всё более распространёнными. Подобно тому, как такие модели генерируют указанные типы данных, они могут также выдавать последовательности действий для роботов. Именно на этом принципе построен проект Gemini Robotics от Google DeepMind, в рамках которого анонсированы две взаимодополняющие модели, позволяющие роботам «думать» перед тем, как действовать. Хотя традиционные большие языковые модели (LLM) имеют ряд ограничений, внедрение симулированного рассуждения значительно расширило их возможности, и теперь аналогичный прорыв может произойти в робототехнике.

Команда Google DeepMind считает, что генеративный ИИ способен кардинально изменить робототехнику, обеспечив роботам универсальную функциональность. В отличие от современных систем, которые требуют месяцев настройки под одну узкоспециализированную задачу и плохо адаптируются к новым условиям, новые ИИ-подходы позволяют роботам работать в незнакомых средах без перепрограммирования. Как отметила Каролина Парада (Carolina Parada), руководитель направления робототехники в DeepMind, роботы на сегодняшний день «чрезвычайно специализированы и сложны в развёртывании».

Для реализации концепции DeepMind разработала Gemini Robotics-ER 1.5 и Gemini Robotics 1.5. Первая — это модель «зрение–язык» (VLM) с функцией воплощённого рассуждения (embodied reasoning), которая анализирует визуальные и текстовые данные, формирует пошаговый план выполнения задачи и может подключать внешние инструменты, например, поиск Google для уточнения контекста. Вторая — модель «зрение–язык–действие» (VLA), которая преобразует полученные инструкции в физические действия робота, одновременно корректируя их на основе визуальной обратной связи и собственного процесса «обдумывания» каждого шага. По словам Канишки Рао (Kanishka Rao) из DeepMind, ключевым прорывом стало наделение робота способностью имитировать интуитивные рассуждения человека, то есть думать перед тем, как действовать.

Разработчики наглядно продемонстрировали, как работают новые модели — наделённый Gemini Robotics 1.5 человекоподобный робот Apollo на видео упаковывает вещи для поездки, а другой робот Aloha 2, точнее пара роборук — сортирует мусор.

Обе модели основаны на фундаментальной архитектуре Gemini, но дополнительно дообучены на данных, отражающих взаимодействие с физическим миром. Это позволяет роботам выполнять сложные многоэтапные задачи, приближая их к уровню автономных агентов. При этом система демонстрирует кроссплатформенную совместимость. В частности, навыки, внедрённые в одного робота, например, на двурукого Aloha 2, могут быть перенесены на другого, включая гуманоида Apollo, без дополнительной настройки под конкретную механику.

Несмотря на вероятный технологический прорыв, практическое применение технологии пока ограничено. Модель Gemini Robotics 1.5, отвечающая за управление роботами, доступна только доверенным тестировщикам. В то же время Gemini Robotics-ER 1.5 уже интегрирована в Google AI Studio, что даёт разработчикам возможность генерировать инструкции для собственных экспериментов с физически воплощёнными роботами. Однако, как считает Райан Уитвам (Ryan Whitwam) из Ars Technica, до появления бытовых роботов, способных выполнять повседневные задачи, ещё предстоит пройти значительный путь.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
SLI переродилась: нейросетевой рендеринг DLSS 5 научились выносить на вторую видеокарту, как это было в первых демонстрациях Nvidia 16 мин.
Российская «КриптоПро» разработает новый браузер со встроенной криптографией 3 ч.
Разработчики нашумевшей гоночной игры Forza Horizon 6 опровергли слухи о переносе релиза на PS5 3 ч.
Календарь релизов 7–13 сентября: Sprawl Zero, Wardogs, Hot Wheels Infinite Rush и Halloween 12 ч.
Хакеры взломали Liquid Network и похитили биткоины на $320 млн 13 ч.
Инсайдеры раскрыли, чего ждать от загадочного шутера Blizzard по StarCraft 13 ч.
Моддер поразил фанатов демонстрацией кооператива и вида от третьего лица для классического стелс-экшена Metal Gear Solid 15 ч.
Huawei представила ускоренную HarmonyOS 7 с ИИ-агентами, защитой от мошенников и новым интерфейсом 16 ч.
«Погибнут многие храбрые рыцари»: многострадальная MMO по League of Legends превратилась для Riot Games в поход за Святым Граалем 16 ч.
Новый трейлер подтвердил дату выхода Airframe Ultra — ретрофутуристического гоночного боевика, который выглядит как дитя Road Rash и «Акиры» 18 ч.
Производство передовых чипов ускорится — TSMC, Samsung и Intel договорились о переходе на увеличенные фотомаски 55 мин.
Arm представила платформу для создания серверных процессоров Neoverse CSS N4 Ranger: до 128 ядер на кристалл, LPDDR6 и PCIe 7.0 2 ч.
Репортаж со стенда Hisense на IFA 2026: телевизоры с обновленной подсветкой RGB MiniLED, огромный MicroLED и умная бытовая техника 2 ч.
Flex купит EPC Power за $4,4 млрд для развития продуктов 800 В DC 2 ч.
В России начались продажи смарт-часов Huawei Watch GT 7 и GT 7 Pro с новыми режимами и автономностью до 21 дня 2 ч.
Китайская CXMT первой в мире начала массовые поставки памяти типа LPDDR6 для смартфонов 4 ч.
Новая статья: Компьютер месяца — сентябрь 2026 года 10 ч.
Новая статья: Обзор умных часов HUAWEI WATCH GT 7 Pro: пора вставать на лыжи 11 ч.
Xiaomi обновила 27-дюймовый монитор Redmi A27U — разрешение 4K, частота 240 Гц и 90-Вт зарядка USB-C 13 ч.
SK hynix успешно расширяет производство памяти DRAM по передовому техпроцессу 1c 13 ч.