Сегодня 01 октября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → gemini omni

Google представила ИИ-генератор видео Gemini Omni 1.1 Flash

Google анонсировала модель искусственного интеллекта Gemini Omni 1.1 Flash, предназначенную для генерации видео. Проект представляет собой попытку решить задачу о том, как по заданному образцу из нескольких кадров сгенерировать органичный ролик — разработчикам предоставляется больший контроль над тем, что происходит между первым и последним кадром.

 Источник изображения: blog.google

Источник изображения: blog.google

Важнейшее нововведение Google Gemini Omni 1.1 Flash — способность модели запоминать существующее видео, когда она получает инструкцию продолжить сцену; модель полагается не только на последние кадры, а на 10 секунд предшествующего видеоматериала. Это помогает ей сохранять персонажей, окружение и общее направление сцены более согласованными, и не приходится угадывать, что должно произойти дальше. Расширился набор возможностей для продолжения исходных сцен. Видео можно удлинять фрагментами по 10 секунд, пока общая длина ролика не достигнет 40 секунд. Этот промежуток может показаться не таким уж продолжительным по сравнению с традиционным видео, но открывается более широкий набор возможностей для генерации последовательностей с помощью ИИ — с заданными началом, серединой и концом.

Это значит, что пользователь может предоставить первый и последний кадры, а Google Gemini Omni 1.1 Flash сгенерирует всё необходимое для их соединения. Это может быть движение камеры вокруг объекта, плавное масштабирование композиции или зацикленный ролик. Можно отправить модели до трёх секунд реального видео для дополнительного визуального контекста, а она сама, например, изобразит появление персонажа в сгенерированной сцене. На этапе предварительных материалов максимальное качество видео не требуется — они могут генерироваться в разрешении 360p, что позволяет ИИ работать на 60 % быстрее, чем в случае с 720p, и втрое дешевле. Можно протестировать задумку, скорректировать подсказки, проработать несколько версий, и когда результат окажется оптимальным, Omni 1.1 Flash создаст видео в 1080p или масштабирует его до 4K.

Доступ к Google Gemini Omni 1.1 Flash уже открылся через API Gemini в Google AI Studio, корпоративные клиенты могут поработать с моделью через Google Agent Platform. Частные пользователи при наличии подписки Google AI Plus, Pro и Ultra могут открыть новую модель в Google Flow; для них функция расширения сцены появится и в основном приложении Gemini.

В YouTube появился ИИ-поиск по роликам и генератор Shorts на базе Gemini Omni

На конференции Google I/O представлена функция поиска на базе искусственного интеллекта, позволяющая искать на YouTube ответы внутри платформы через диалоговый интерфейс с подборкой видео и текстовыми аннотациями. Также в мобильное приложение YouTube Create будет внедрена ИИ-модель Gemini Omni для генерации и ремиксов видео.

 Источник изображения: Google

Источник изображения: Google

Функция Ask YouTube работает следующим образом: система анализирует запрос пользователя и формирует выдачу из длинных или коротких видео (Shorts), предлагая небольшие текстовые резюме для быстрого анализа содержания. Пользователь может задать уточняющие вопросы, чтобы сузить или скорректировать результаты. Новая функция уже доступна подписчикам YouTube Premium в США через экспериментальную площадку YouTube Labs.

 Источник изображения: engadget.com

Источник изображения: engadget.com

Параллельно с этим разработчики интегрировали модель Gemini Omni в приложение Create и в инструмент создания ремиксов коротких видео. Теперь нейросеть способна создавать видеоролики, объединяя изображения, аудио, исходные видео и текстовые запросы в единый визуальный ряд. В Google заявляют, что обновлённый алгоритм точнее распознаёт намерения пользователя, обеспечивая логичные и последовательные результаты, что в итоге повышает качество генерируемого контента.

Интеграция Gemini Omni в инструменты создания контента началась сегодня. На текущем этапе монетизация новых функций не предусмотрена. Ask YouTube входит в пакет подписки Premium, а доступ к бета-тестированию осуществляется бесплатно через программу YouTube Labs.

Как отмечает Engadget, нововведение происходит на фоне стремления социальных сетей ограничить распространение спама и низкокачественного автоматизированного контента.

Google случайно показала грядущий ИИ Omni, который генерирует видео по тексту

Новая модель Gemini Omni компании Google появилась в ранних демонстрациях, показав впечатляющие результаты генерации видео по текстовым запросам. Некоторые пользователи уже протестировали функцию создания роликов, хотя компания ещё не объявила о запуске официально.

 Источник изображения: Solen Feyissa/Unsplash

Источник изображения: Solen Feyissa/Unsplash

Как стало известно 9to5Google, модель позволяет создавать видеоремиксы, редактировать контент непосредственно в диалоговом окне чат-бота, а также использовать готовые шаблоны. Метаданные в приложении Gemini указывают на то, что Omni является расширением платформы Veo, однако какое место займёт модель экосистеме продуктов компании, пока неизвестно.

https://9to5google.com/wp-content/uploads/sites/4/2026/05/A_professor_writes_out_a_mathe.mp4

В одном из тестовых роликов ИИ сгенерировал сцену, в которой профессор пишет математическое доказательство на учебной доске, корректно отобразив формулы и последовательность объяснений.

Во втором запросе была воссоздана сцена с двумя мужчинами, которые едят спагетти в ресторане у моря. Результат получился достаточно реалистичным, хотя и с заметными артефактами, характерными для современных генеративных моделей. Оба запроса заняли 86 % дневного лимита использования в аккаунте тарифа AI Pro.

Разработчики пока не представили продукт публично, однако ранее подтвердили приверженность развитию технологий, связанных с генерацией видео, в особенности после решения конкурента прекратить поддержку Sora. Ожидается, что дополнительные детали, касающиеся генерации видео, станут известны на предстоящей конференции Google I/O 2026, где компания традиционно представляет ключевые обновления своих платформ.


window-new
Soft
Hard
Тренды 🔥
Ретрофэнтезийный ролевой боевик Queen’s Domain в духе King's Field не заставит себя долго ждать — новый трейлер и дата выхода 2 ч.
Неизвестные ИИ-агенты атаковали сайт правительства Канады 2 ч.
Россияне стали чаще использовать «Яндекс Браузер» из-за проблем с сертификатами отечественных сайтов 3 ч.
Гендиректор Xbox: вопреки упорным слухам, игровой бизнес Microsoft «не продаётся» 4 ч.
В процессорах Intel, AMD и Arm нашли новую версию уязвимости Spectre v2 — она угрожает утечкой паролей и других данных 4 ч.
Reddit развернула борьбу с ИИ-ботами, но её жертвами оказались обычные пользователи 6 ч.
Китайская открытая GLM-5.3 почти догнала закрытую Mythos в создании эксплойтов 7 ч.
Слухи: следующей игрой Naughty Dog после Intergalactic: The Heretic Prophet станет Uncharted 5, а The Last of Us Part III придётся подождать 7 ч.
OpenAI обвинила китайскую Moonshot в массовом извлечении данных для обучения ИИ-моделей 8 ч.
Хакеры получили доступ к персональным данным почти 3 млн служащих Министерства обороны США 9 ч.
Подорожание памяти DRAM и NAND в этом квартале замедлится — но совсем чуть-чуть 14 мин.
Японский Google изобрёл вертикальную клавиатуру-конвейер Gboard Kuru-Kuru — построить её может любой желающий 24 мин.
Huawei представила флагман Mate 90 RS с уникальным дизайном и самым мощным процессором Kirin 27 мин.
OpenYard выпустила GPU-серверы RG2D4 на базе Intel Xeon Granite Rapids и AMD EPYC Turin 38 мин.
Huawei представила первые многослойные процессоры, созданные по технологии LogicFolding 2 ч.
Китайская Tencent арендует 100 000 ускорителей ИИ у американской Oracle за $7 млрд 3 ч.
Micron: память продолжит дорожать в 2027 году, а дефицит может сохраниться даже после 2028 года 3 ч.
Смартфоны Huawei скоро подорожают — компания больше не может сдерживать рост цен из-за дефицита памяти 6 ч.
РТК-ЦОД обеспечил EdgeЦентр технологической базой для высоконагруженного инфраструктурного хаба 6 ч.
Schneider Electric испытывает в ЦОД Equinix распределительные устройства среднего напряжения с программным управлением 7 ч.