Сегодня 08 июня 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

«Сбер» представил нейросеть Kandinsky Video — она генерирует 8-секундные видео по текстовому описанию

«Сбер» представил нейросеть Kandinsky Video, способную создавать небольшие ролики по текстовому описанию. Алгоритм генерирует видеоряд продолжительностью до 8 секунд с частотой 30 кадров в секунду. Новинка была презентована в рамках конференции AI Journey первым заместителем председателя правления «Сбербанка» Александром Ведяхиным.

 Источник изображения: sberbank.com

Источник изображения: sberbank.com

Архитектура Kandinsky Video включает в себя два основных блока. Первый блок отвечает за генерацию ключевых кадров, используемых для создания структуры сюжета видео, а второй — генерирует интерполяционные кадры, за счёт чего достигается плавность движения в финальном ролике. Оба блока построены на базе модели синтеза изображений по текстовым описаниям Kandinsky 3.0.

В конечном счёте алгоритм создаёт видео с движением как объекта, так и фона. Это отличает сгенерированные нейросетью видео от анимационных роликов, в которых динамика достигается за счёт моделирования полёта камеры относительно статичной сцены. В настоящее время Kandinsky Video может создавать видео с разрешением 512 × 512 пикселей и разным соотношением сторон. Для обучения алгоритма использовался датасет из более чем 300 тыс. пар «текст-видео». Сам же процесс генерации ролика занимает до 3 минут.

Отмечается, что ранее некоторые пользователи нейросети Kandinsky 2.2 в тестовом режиме получили доступ к функции создания анимационных роликов. Всего одного запроса достаточно для генерации видео продолжительностью до 4 секунд с выбранными эффектами анимации, частотой 24 кадра в секунду и разрешением 640 × 640 пикселей. Пользователи новой версии Kandinsky 3.0 также могут генерировать ролики по текстовому описанию в режиме анимации.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Nvidia планирует построить 100 новых ИИ-фабрик по всему миру 5 ч.
Запрет на TikTok в США может быть отложен на неопределённый срок 10 ч.
Высокий суд Англии вывел на чистую воду адвокатов, использующих ИИ, — они ссылались на фейковые прецеденты 10 ч.
Новая статья: Blades of Fire — и боец, и кузнец. Рецензия 11 ч.
Owlcat Games анонсировала ролевой боевик The Expanse: Osiris Reborn в духе Mass Effect — первый трейлер и подробности 11 ч.
В Северной Корее внезапно пропал интернет, и никто не знает, почему 14 ч.
Магазин Microsoft Store обновился — больше системных интеграций, кнопка Copilot и повышение производительности 14 ч.
Состоялся анонс Mortal Shell 2 — продолжения зрелищного боевика про беспощадное избиение уродливых монстров 17 ч.
AMD впервые приняла участие в бенчмарке MLPerf Training, но до рекордов NVIDIA ей ещё очень далеко 19 ч.
Хакеры обнаружили уязвимость в Nintendo Switch 2 спустя день после релиза 22 ч.
Сроки строительства гигаваттного ЦОД в ОАЭ растянутся из-за проблем в сфере безопасности 3 ч.
Китайские власти пытаются добиться смягчения европейских санкций в высокотехнологичной сфере 4 ч.
Акции Broadcom упали из-за слабого прогноза, несмотря рост прибыли и выручки 12 ч.
Признаки жизни, сенсационно обнаруженные на экзопланете K2-18b, теперь вызывают у учёных сомнения 12 ч.
От «железа» до агентов: «К2 НейроТех» представил ПАК-AI для разработки и внедрения ИИ на предприятиях 12 ч.
Meta объявила, что текущий год станет «поворотным» для виртуальной и дополненной реальности 18 ч.
HPE представила отказоустойчивые системы Nonstop Compute на базе Intel Xeon Sapphire Rapids 19 ч.
Synology выпустила стоечное хранилище RackStation RS2825RP+ с процессором AMD Ryzen Embedded 19 ч.
Трамп отказался от перемирия с Маском и угрожает урезать ему правительственные контракты 19 ч.
Трамп разрешил сверхзвуковые полёты над США, а также подписал указы об аэротакси и дронах 20 ч.