Сегодня 27 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

Google DeepMind дала роботам ИИ, с которым они могут выполнять сложные задания без предварительного обучения

Лаборатория Google DeepMind представила две новые модели ИИ, которые помогут роботам «выполнять более широкий спектр реальных задач, чем когда-либо прежде». Gemini Robotics — это модель «зрение-язык-действие», способная понимать новые ситуации без предварительного обучения. А Gemini Robotics-ER компания описывает как передовую модель, которая может «понимать наш сложный и динамичный мир» и управлять движениями робота.

 Источник изображений: Google DeepMind

Источник изображений: Google DeepMind

Модель Gemini Robotics построена на основе Gemini 2.0, последней версии флагманской модели ИИ от Google. ПО словам руководителя отдела робототехники Google DeepMind Каролины Парада (Carolina Parada), Gemini Robotics «использует мультимодальное понимание мира Gemini и переносит его в реальный мир, добавляя физические действия в качестве новой модальности».

Новая модель особенно сильна в трёх ключевых областях, которые, по словам Google DeepMind, необходимы для создания по-настоящему полезных роботов: универсальность, интерактивность и ловкость. Помимо способности обобщать новые сценарии, Gemini Robotics лучше взаимодействует с людьми и их окружением. Модель способна выполнять очень точные физические задачи, такие как складывание листа бумаги или открывание бутылки.

«Хотя в прошлом мы уже достигли прогресса в каждой из этих областей по отдельности, теперь мы приносим [резко] увеличивающуюся производительность во всех трёх областях с помощью одной модели, — заявила Парада. — Это позволяет нам создавать роботов, которые более способны, более отзывчивы и более устойчивы к изменениям в окружающей обстановке».

Модель Gemini Robotics-ER разработана специально для робототехников. С её помощью специалисты могут подключаться к существующим контроллерам низкого уровня, управляющим движениями робота. Как объяснила Парада на примере упаковки ланч-бокса — на столе лежат предметы, нужно определить, где что находится, как открыть ланч-бокс, как брать предметы и куда их класть. Именно такой цепочки рассуждений придерживается Gemini Robotics-ER.

Разработчики уделили серьёзное внимание безопасности. Исследователь Google DeepMind Викас Синдхвани (Vikas Sindhwani) рассказал, как лаборатория использует «многоуровневый подход», при котором модели Gemini Robotics-ER «обучаются оценивать, безопасно ли выполнять потенциальное действие в заданном сценарии».

Кроме того, Google DeepMind разработала ряд эталонных тестов и фреймворков, чтобы помочь дальнейшим исследованиям безопасности в отрасли ИИ. В частности, в прошлом году лаборатория представила «Конституцию робота» — набор правил, вдохновлённых «Тремя законами робототехники», сформулированными Айзеком Азимовым в рассказе «Хоровод» в 1942 году.

В настоящее время Google DeepMind совместно с компанией Apptronik разрабатывает «следующее поколение человекоподобных роботов». Также лаборатория предоставила доступ к своей модели Gemini Robotics-ER «доверенным тестировщикам», среди которых Agile Robots, Agility Robotics, Boston Dynamics и Enchanted Tools.

«Мы полностью сосредоточены на создании интеллекта, который сможет понимать физический мир и действовать в этом физическом мире, — сказала Парада. — Мы очень рады использовать это в нескольких воплощениях и во многих приложениях для нас».

Напомним, что в сентябре 2024 года исследователи из Google DeepMind продемонстрировали метод обучения, позволяющий научить робота выполнять некоторые требующие определённой ловкости действия, такие как завязывание шнурков, подвешивание рубашек и даже починка других роботов.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про мир роботехники

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
«Мы уже достигли AGI» — Дженсен Хуанг объявил главную цель разработчиков ИИ бессмысленной 18 мин.
Журналисты разразились подробностями GTA VI — как никогда отзывчивый мир, последствия решений и апгрейд ролевых механик из San Andreas 19 мин.
В поисковой выдаче Google появилась ловушка для ИИ-ботов — ссылки спрятали за редиректом 43 мин.
Owlcat объявила дату релиза Shadow of the Road — пошаговой RPG в феодальной Японии, где смешались магия и стимпанк 2 ч.
Кинематографический боевик Spine в духе «Джона Уика» выйдет летом 2027 года: новый трейлер 2 ч.
OpenAI видела признаки выхода ИИ-агентов из-под контроля, но ничего не сделала 2 ч.
Google представила Gemini 3.5 Transcribe — ИИ превратит живую речь в готовый текст без слов-паразитов 3 ч.
«Нет даже плана для плана»: Билл Гейтс предупредил о неготовности мира к эпохе ИИ 4 ч.
Devolver Digital анонсировала игру, которая выйдет в один день с GTA VI 5 ч.
Высший демон Хаоса, безостановочный экшен и музыка Мика Гордона: взрывной трейлер раскрыл дату выхода олдскульного шутера Warhammer 40,000: Boltgun 2 5 ч.
Представлена умная колонка «СберБум 2.0» с «ГигаЧатом» 11 мин.
Lenovo выпустила первую Android-консоль Legion с поддержкой трансляции игр с ПК 24 мин.
CXMT научилась производить LPDDR6 — Xiaomi уже подружила её с процессором Xring O3 2 ч.
Дженсен Хуанг не боится ИИ-пузыря — ускорители без дела не останутся, и вообще «риск очень мал» 2 ч.
Kraftway представляет линейку эргономичных мониторов KraftView с расширенными возможностями подключения 3 ч.
ФАС завела дело против «МегаФона» из-за рекламы 5G, создающей иллюзию его внедрения 3 ч.
Поставки ИИ-ускорителей Nvidia в Китай действительно возобновились — но объёмы мизерные 3 ч.
NVIDIA придумала собственную память NVHBM с интегрированным контроллером 4 ч.
Коптите сколько хотите: Агентство по охране окружающей среды (EPA) США разрешит ЦОД не оповещать жителей о выбросах 4 ч.
MTIA 300: первый ИИ-чип Meta со встроенными 800GbE-адаптерами и механизмами разгрузки коммуникаций 4 ч.