Сегодня 19 мая 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

Waymo и Gemini научат роботакси справляться со сложными дорожными ситуациями

Waymo, дочерняя компания Alphabet, представила новый подход к обучению своих беспилотных транспортных средств, используя модель Gemini — большую мультимодальную языковую модель (MLLM) от Google. Модель улучшит навигацию автономных автомобилей и позволит лучше справляться со сложными дорожными ситуациями.

 Источник изображения: waymo.com

Источник изображения: waymo.com

В новом исследовательском докладе Waymo дала определение своей разработке как «сквозной мультимодальной модели для автономного вождения» (EMMA), которая обрабатывает данные с сенсоров и помогает роботакси принимать решения о направлении движения, избегая препятствий. Как пишет The Verge, Waymo давно подчёркивала своё стратегическое преимущество благодаря доступу к научным исследованиям в области искусственного интеллекта (ИИ) Google DeepMind, ранее принадлежавшей британской компании DeepMind Technologies.

Новая система EMMA представляет собой принципиально иной подход к обучению автономных транспортных средств. Вместо традиционных модульных систем, которые разделяют функции на восприятие, планирование маршрута и другие задачи, EMMA предлагает единый подход, который позволит обрабатывать данные комплексно, поможет избежать ошибок, возникающих при передаче данных между модулями, и улучшит адаптацию к новым, незнакомым условиям на дороге в реальном масштабе времени.

Одним из ключевых преимуществ использования моделей MLLM, в частности Gemini, является их способность к обобщению знаний, почерпнутых из огромных объёмов данных, полученных из интернета. Это позволяет моделям лучше адаптироваться к нестандартным ситуациям на дороге, таким как неожиданное появление животных или ремонтные работы. Кроме того, модели, обученные на основе Gemini, способны к «цепочке рассуждений». Это метод, который помогает разбивать сложные задачи на последовательные логические шаги, улучшая процесс принятия решений.

Несмотря на успехи, Waymo признает, что EMMA имеет свои ограничения. Например, модель пока не поддерживает обработку 3D-данных с таких сенсоров, как лидар или радар, из-за высокой вычислительной сложности. Кроме того, EMMA способна обрабатывать лишь ограниченное количество кадров изображений одновременно. Подчёркивается, что потребуется дальнейшее исследование для преодоления всех этих ограничений перед полноценным внедрением модели в реальных условиях.

Waymo также осознает и риски, связанные с использованием MLLM в управлении автономными транспортными средствами. Модели, подобные Gemini, могут допускать ошибки или «галлюцинировать» в простых задачах, что конечно недопустимо на дороге. Тем не менее, есть надежда, что дальнейшие исследования и улучшения архитектуры ИИ-моделей для автономного вождения преодолеют эти проблемы.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Илон Маск назвал решение суда по делу OpenAI «техническим» и пообещал его обжаловать 3 мин.
РТК-ЦОД представил модульное решение «Ковчег» для обеспечения полной сохранности данных 2 ч.
«Яндекс» повысил грамотность «Алисы AI» при генерации картинок с русским текстом 4 ч.
Мультяшный экшен Into The Unwell не выйдет в 2026 году — разработчики слишком бурно отпраздновали День вафель 4 ч.
Meta принудительно переведёт 7000 сотрудников на должности в сфере ИИ 4 ч.
Передовые чат-боты с ИИ провалились в роли радиоведущих — каждый по своему 5 ч.
Похоже, Lords of the Fallen 2 всё-таки выйдет в Steam — CI Games разорвала издательское соглашение с Epic Games 5 ч.
В России появится единая платформа управления IT-сервисами и инфраструктурой 5 ч.
Xbox открыла портал Xbox Player Voice для сбора отзывов — игроки требуют эксклюзивы и бесплатный мультиплеер 7 ч.
«Если хочется поубивать, идите в Sons of the Forest»: разработчики Subnautica 2 отказались добавлять в игру убийства, но моддеры тут как тут 7 ч.
Arm-процессоры NVIDIA Vera поставили в ведущие ИИ-лаборатории мира — Oracle развернёт сотни тысяч таких CPU 13 мин.
Китайские учёные впервые воспроизвели механизм гибели нашей Вселенной в сценарии ложного вакуума 4 ч.
Иран намекнул на уязвимость подводных кабелей в Ормузском проливе, пригрозив ввести сборы за их использование 4 ч.
«МегаФон» показал станцию для запуска сети 5G и 4G в любой точке России — через отечественный аналог Starlink 4 ч.
LG выпустит первый игровой монитор с частотой обновления 1000 Гц и разрешением 1080p 4 ч.
Мировые поставки OLED-мониторов за год подскочили на 78 % — почти четверть рынка за Asus 4 ч.
AMD и NVIDIA свернули не туда: следующий крупный американский суперкомпьютер может получить HPC-чипы NextSilicon 5 ч.
В России стартовали продажи смартфона Realme 16 5G с селфи-зеркалом у основной 50-Мп камеры — от 33 тыс. рублей 7 ч.
NextEra Energy купит Dominion Energy, превратившись в крупнейшую в мире регулируемую энергокомпанию 7 ч.
Intel и Qualcomm поборются за ИИ-стартап Джима Келлера стоимостью $5 млрд 7 ч.