Сегодня 26 апреля 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

«Сбер» представил нейросеть Kandinsky Video — она генерирует 8-секундные видео по текстовому описанию

«Сбер» представил нейросеть Kandinsky Video, способную создавать небольшие ролики по текстовому описанию. Алгоритм генерирует видеоряд продолжительностью до 8 секунд с частотой 30 кадров в секунду. Новинка была презентована в рамках конференции AI Journey первым заместителем председателя правления «Сбербанка» Александром Ведяхиным.

 Источник изображения: sberbank.com

Источник изображения: sberbank.com

Архитектура Kandinsky Video включает в себя два основных блока. Первый блок отвечает за генерацию ключевых кадров, используемых для создания структуры сюжета видео, а второй — генерирует интерполяционные кадры, за счёт чего достигается плавность движения в финальном ролике. Оба блока построены на базе модели синтеза изображений по текстовым описаниям Kandinsky 3.0.

В конечном счёте алгоритм создаёт видео с движением как объекта, так и фона. Это отличает сгенерированные нейросетью видео от анимационных роликов, в которых динамика достигается за счёт моделирования полёта камеры относительно статичной сцены. В настоящее время Kandinsky Video может создавать видео с разрешением 512 × 512 пикселей и разным соотношением сторон. Для обучения алгоритма использовался датасет из более чем 300 тыс. пар «текст-видео». Сам же процесс генерации ролика занимает до 3 минут.

Отмечается, что ранее некоторые пользователи нейросети Kandinsky 2.2 в тестовом режиме получили доступ к функции создания анимационных роликов. Всего одного запроса достаточно для генерации видео продолжительностью до 4 секунд с выбранными эффектами анимации, частотой 24 кадра в секунду и разрешением 640 × 640 пикселей. Пользователи новой версии Kandinsky 3.0 также могут генерировать ролики по текстовому описанию в режиме анимации.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Электронную подпись через «Госключ» получили более 20 млн россиян 4 ч.
Все популярные модели генеративного ИИ оказалось легко взломать по схеме Policy Puppetry 5 ч.
Учёные уличили ИИ в неспособности строить математические доказательства в олимпиадных задачах USAMO 2025 года 5 ч.
«Клянусь Азурой!»: за три дня в The Elder Scrolls IV: Oblivion Remastered сыграло более 4 миллионов человек 6 ч.
ИИ-помощник Google Gemini появится в автомобилях, умных часах и наушниках 6 ч.
ФБР объявило награду $10 млн за данные о хакерах Salt Typhoon 6 ч.
Прокуратура США усомнилась в праве «Википедии» на налоговые льготы из-за иностранного вмешательства 7 ч.
Холдинг xAI Илона Маска готовится привлечь $20 млрд в свой капитал 11 ч.
Новая статья: Hollywood Animal — тёмная сторона Голливуда. Предварительный обзор 17 ч.
Релиз шутера La Quimera от бывших разработчиков Metro отложили после разгромных обзоров — игра должна была выйти сегодня 18 ч.
Портативная консоль Figment объединила книги и генерацию сюжетов с помощью ИИ 3 мин.
Alphabet в полтора раза нарастил квартальную прибыль и подтвердил планы потратить $75 млрд на ИИ-инфраструктуру 4 ч.
Марсоход Curiosity впервые сфотографировали с орбиты во время передвижения по Красной планете 5 ч.
Общественники уличили xAI Илона Маска во лжи — её мощнейший ИИ-суперкомпьютер тайно вредит экологии 6 ч.
В процессорах Nova Lake будет больше кристаллов Intel, чем в Panther Lake 9 ч.
В этом году Intel выпустит самые мощные процессоры Panther Lake, а версии подешевле появятся в следующем 12 ч.
NASA начало тестировать лунную поверхность на способность принять тяжёлые посадочные модули 19 ч.
TP-Link попала под двойное расследование из-за очень низких цен и угрозы нацбезопасности США 20 ч.
Роботакси на продажу: Waymo задумала предлагать беспилотные авто всем желающим 20 ч.
Curator: в I квартале количество DDoS-атак выросло более чем вдвое, а рекордный ботнет «захватил» сразу 1,33 млн устройств 21 ч.