Сегодня 18 мая 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

«Сбер» представил нейросеть Kandinsky Video — она генерирует 8-секундные видео по текстовому описанию

«Сбер» представил нейросеть Kandinsky Video, способную создавать небольшие ролики по текстовому описанию. Алгоритм генерирует видеоряд продолжительностью до 8 секунд с частотой 30 кадров в секунду. Новинка была презентована в рамках конференции AI Journey первым заместителем председателя правления «Сбербанка» Александром Ведяхиным.

 Источник изображения: sberbank.com

Источник изображения: sberbank.com

Архитектура Kandinsky Video включает в себя два основных блока. Первый блок отвечает за генерацию ключевых кадров, используемых для создания структуры сюжета видео, а второй — генерирует интерполяционные кадры, за счёт чего достигается плавность движения в финальном ролике. Оба блока построены на базе модели синтеза изображений по текстовым описаниям Kandinsky 3.0.

В конечном счёте алгоритм создаёт видео с движением как объекта, так и фона. Это отличает сгенерированные нейросетью видео от анимационных роликов, в которых динамика достигается за счёт моделирования полёта камеры относительно статичной сцены. В настоящее время Kandinsky Video может создавать видео с разрешением 512 × 512 пикселей и разным соотношением сторон. Для обучения алгоритма использовался датасет из более чем 300 тыс. пар «текст-видео». Сам же процесс генерации ролика занимает до 3 минут.

Отмечается, что ранее некоторые пользователи нейросети Kandinsky 2.2 в тестовом режиме получили доступ к функции создания анимационных роликов. Всего одного запроса достаточно для генерации видео продолжительностью до 4 секунд с выбранными эффектами анимации, частотой 24 кадра в секунду и разрешением 640 × 640 пикселей. Пользователи новой версии Kandinsky 3.0 также могут генерировать ролики по текстовому описанию в режиме анимации.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Новая статья: The Precinct: вы имеете право хранить молчание. Рецензия 15 ч.
Android-приложения получат доступ к ИИ-модели Gemini Nano, которая работает прямо на смартфоне 17-05 13:19
Epic Games снова обратилась в суд, чтобы принудить Apple вернуть Fortnite на iPhone 17-05 12:37
Intel выпустила важные исправления безопасности для устранения уязвимостей в Core Ultra, Arc и серверных GPU 17-05 07:32
OpenAI станет одним из основных пользователей крупного ЦОД в ОАЭ 17-05 06:34
Microsoft отделила Teams от Office в попытке увернуться от штрафа в ЕС 17-05 00:41
Новая статья: «Приключения Капитана Блада» — ахой из прошлого. Рецензия 17-05 00:00
Не будут брать подписку — отключим апдейт: Broadcom нарушила обещание поддерживать VMware с «вечными» лицензиями 16-05 23:14
«Мы делаем всё возможное»: создатели Stellar Blade отреагировали на недоступность игры в 130 странах и развеяли опасения фанатов насчёт Denuvo 16-05 23:11
xAI обнародовала секретные промпты для ИИ-бота Grok после скандального сбоя 16-05 21:58
Квартальные поставки Nearline-накопителей сократились на 12 % 10 мин.
Квартальная выручка CoreWeave взлетела в пять раз, но компания продолжает нести убытки 14 мин.
Индия потеряла новый спутник по пути на орбите — у ракеты-носителя PSLV-XL отказал двигатель 2 ч.
Xiaomi намеревается сделать свои электромобили самыми безопасными в отрасли 7 ч.
Первые немногочисленные роботакси Tesla будут контролироваться дистанционно 7 ч.
Глава Nvidia утверждает, что свидетельств контрабанды ускорителей этой марки в Китай нет 8 ч.
TSMC запустит девять новых фабрик вместо пяти в этом году из-за невероятного спроса на ИИ-чипы 14 ч.
Apple может полностью потерять китайский рынок смартфонов — Вашингтон против работы в сфере ИИ с Alibaba 17 ч.
Европа перейдёт на торий и выработанный уран — помимо энергии это сэкономит на захоронении отходов АЭС 17 ч.
Nvidia выпустит новый ИИ-ускоритель для Китая, но это будет уже не Hopper 21 ч.