Сегодня 18 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Google выпустила Gemini Omni — ИИ для генерации видео из текста, фото, аудио и любых других данных

Google представила новое семейство генеративных моделей искусственного интеллекта Gemini Omni, предназначенное для создания контента из любых типов входных данных. Первым продуктом линейки стала нейросеть Gemini Omni Flash, способная генерировать видеоролики на основе текста, фотографий, аудио или других видеозаписей. Алгоритм объединяет мультимодальные возможности с глубоким пониманием законов физики и реального мира.

 Источник изображений: Google

Источник изображений: Google

Ключевым отличием новинки от существующей модели Veo, как пишет Google в своём блоге, является функция преобразования одного видео в другое. Алгоритм не просто генерирует визуальный ряд, но и позволяет редактировать исходные кадры с помощью естественного языка в диалоговом формате, сохраняя логику сцены и последовательность действий персонажей при каждом новом запросе. Как отмечает старший директор по исследованиям Google DeepMind Думитру Эрхан (Dumitru Erhan), в настоящее время система может создавать ролики со звуком продолжительностью до 10 секунд, однако компания уже работает над увеличением этого лимита.

Модель опирается на обширную базу знаний экосистемы Gemini, что позволяет ей создавать сцены с учётом исторического и научного контекста, а также точно воспроизводить гравитацию или динамику жидкостей. Технический директор Google DeepMind и главный ИИ-архитектор Google Корай Кавукчуоглу (Koray Kavukcuoglu) подчеркнул, что новая технология обладает гораздо большей информацией об устройстве мира, чем предыдущие разработки. Пользователи также получат возможность сгенерировать собственный цифровой аватар и озвучить его своим голосом. Руководитель команды разработчиков продукта Николь Брихтова (Nicole Brichtova) указала, что подобная функция интеграции собственной внешности пользовалась огромным спросом в прошлогодней модели для генерации изображений Nano Banana, с помощью которой было создано более 50 миллиардов картинок.

В целях безопасности корпорация пока ограничивает алгоритм в возможности изменять чужую речь на видео, а все сгенерированные ролики автоматически помечаются невидимым цифровым водяным знаком SynthID для проверки подлинности контента. В будущем разработчики планируют добавить поддержку вывода аудио и статических изображений. Модель Gemini Omni Flash уже доступна глобально для подписчиков тарифов Google AI Plus, Pro и Ultra через приложение Gemini и сервис Google Flow.

Начиная с этой недели бесплатный доступ к генератору также открывается для пользователей в приложениях YouTube Shorts и YouTube Create App.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источники:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Несмотря на негатив в соцсетях, Marvel’s Wolverine уже стала хитом и за три дня обошла по продажам Death Stranding 2: On the Beach 20 мин.
«Воровство беспрецедентных масштабов»: OpenAI и Microsoft признали, что ИИ построен на краже данных и неумолимо разрушает интернет 2 ч.
AAA по цене AA: раскрыт бюджет вампирской ролевой игры The Blood of Dawnwalker от ведущих разработчиков The Witcher 3 и Cyberpunk 2077 2 ч.
Более трёх миллионов игроков добавили амбициозный китайский боевик Phantom Blade Zero в список желаемого 3 ч.
Rebel Wolves услышала фанатов — The Blood of Dawnwalker получит режим «Новая игра +» 4 ч.
Эффектное, но утомительное приключение: критики вынесли вердикт Control Resonant 5 ч.
Внедрение «водяных знаков» может сделать поведение ИИ-моделей непредсказуемым 6 ч.
У всех ИИ-агентов для программирования нашлась опасная уязвимость — вредоносный код запускается без участия пользователя 9 ч.
Гендиректор Twitch рассказал, когда разработчики GTA VI выпустят GTA Online 2 10 ч.
Системы OpenAI взломали при помощи ИИ-моделей Anthropic 11 ч.
США строят фабрики для чипов, но работать на них некому — к 2030 году отрасли будет не хватать 157 000 специалистов 4 ч.
Шотландия де-факто ввела временный мораторий на новые ЦОД гиперскейл-уровня 4 ч.
Видеокарта с аниме-амбассадором: Palit представила GeForce RTX 5060 Ti RiTONA OC 4 ч.
OpenAI всерьёз взялась за роботов — компания набирает десятки инженеров и обещает им до $500 000 в год 5 ч.
ИИ-ускорители Huawei Ascend 960DT с 288 Гбайт памяти выйдут в начале 2027 года 5 ч.
Вглубь и вширь: Cornelis анонсировала архитектуру Active Compute Fabric 5 ч.
Китайский ИИ ещё не научился зарабатывать как американский — DeepSeek, Alibaba и ещё пять разработчиков вместе не догнали OpenAI и Anthropic 6 ч.
Schneider Electric представила 2,5-МВт силовые модули для ИИ ЦОД, сокращающие время монтажа 6 ч.
Rune Energy привлекла $40 млн на развитие своих модульных ЦОД на солнечной энергии 6 ч.
Представлен дизайнерский смартфон Tecno Pova 8 Pro 5G Tonino Lamborghini Limited Edition 7 ч.