Сегодня 25 июля 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → stable video 4d

Stability AI представила генератор 4D-видео Stable Video 4D

На фоне популярности генеративных нейросетей уже доступно множество ИИ-алгоритмов для создания видео, таких как Sora, Haiper и Luma AI. Разработчики из Stability AI представили нечто совершенно новое. Речь идёт о нейросети Stable Video 4D, которая опирается на существующую модель Stable Video Diffusion, позволяющую преобразовывать изображения в видео. Новый инструмент развивает эту концепцию, создавая из получаемых видеоданных несколько роликов с 8 разными перспективами.

 Stable Diffusion 3

Stable Diffusion 3

«Мы считаем, что Stable Video 4D будет использоваться в кинопроизводстве, играх, AR/VR и других сферах, где присутствует необходимость просмотра динамически движущихся 3D-объектов с произвольных ракурсов», — считает глава подразделения по 3D-исследованиям в Stability AI Варун Джампани (Varun Jampani).

Это не первый случай, когда Stability AI выходит за пределы генерации двумерного видео. В марте компания анонсировала алгоритм Stable Video 3D, с помощью которого пользователи могут создавать короткие 3D-ролики на основе изображения или текстового описания. С запуском Stable Video 4D компания делает значительный шаг вперёд. Если понятие 3D или три измерения обычно понимается как тип изображения или видео с глубиной, то 4D, не добавляет ещё одно измерение. На самом деле 4D включает в себя ширину (x), высоту (y), глубину (z) и время (t). Это означает, что Stable Video 4D позволяет смотреть на движущиеся 3D-объекты с разных точек обзора и в разные моменты времени.

«Ключевые аспекты, которые позволили создать Stable Video 4D, заключаются в том, что мы объединили сильные стороны наших ранее выпущенных моделей Stable Video Diffusion и Stable Video 3D, а также доработали их с помощью тщательно подобранного набора данных динамически движущихся 3D-объектов», — пояснил Джампани. Он также добавил, что Stable Video 4D является первым в своём роде алгоритмом, в котором одна нейросеть выполняет синтез изображения и генерацию видео. В уже существующих аналогах для решения этих задач используются отдельные нейросети.

«Stable Video 4D полностью синтезирует восемь новых видео с нуля, используя для этого входное видео в качестве руководства. Нет никакой явной передачи информации о пикселях с входа на выход, вся эта передача информации осуществляется нейросетью неявно», — добавил Джампани. Он добавил, что на данный момент Stable Video 4D может обрабатывать видео с одним объектом длительностью несколько секунд с простым фоном. В дальнейшем разработчики планируют улучшить алгоритм, чтобы он мог использоваться для обработки более сложных видео.


window-new
Soft
Hard
Тренды 🔥
Депутат Хинштейн объявил о начале замедления YouTube на этой неделе 13 мин.
«Забудьте GTA VI»: фотореалистичная стратегия Empire of the Ants получила трейлер дискового издания и предварительные системные требования 17 мин.
Отказ от комиссии за отмену подписки будет для Adobe «большим ударом по бизнесу», признал один из руководителей 21 мин.
Грандиозный мод Fallout: London для Fallout 4 наконец вышел — релизный трейлер и особенности установки 2 ч.
Майнер-одиночка добыл блок биткоина — вознаграждение составило более $200 тысяч 3 ч.
Ethereum столкнулся с сильнейшим падением за три месяца, несмотря за запуск спотовых ETF 4 ч.
«Базальт СПО» приглашает на XX конференцию разработчиков свободных программ 5 ч.
В России выросла популярность отечественных облачных хранилищ, хотя молодёжь предпочитает иностранные 6 ч.
«Вы владеете Concord, а не Concord вами»: в геройском шутере от Sony не будет боевого пропуска 6 ч.
Сбой CrowdStrike обошёлся компаниям из Fortune 500 в $5,4 миллиарда 6 ч.
Apple откроет в Китае лабораторию для повышения качества и надёжности будущих iPhone, iPad и других 49 мин.
Никакой интриги: очередная утечка раскрыла характеристики и функции смартфонов Google Pixel 9 2 ч.
Представлены доступные 5G-смартфоны HMD Crest и Crest Max с 50-Мп фронтальными камерами 2 ч.
Omdia: спрос на готовые модульные дата-центры и микро-ЦОД вырос благодаря развитию рынка ИИ 3 ч.
Blackstone намерена расширить свой портфель ЦОД, инвестировав в их развитие ещё $70 млрд 3 ч.
Colorful представила материнскую плату CVN Z790D5 Ark Frozen для Intel Core 14-го, 13-го и 12-го поколений 3 ч.
Oppo Find X8 Ultra получит тонкий корпус, но мощный аккумулятор на 6000 мА·ч 4 ч.
Lumen расширит оптические каналы связи между ИИ ЦОД Microsoft, а сама частично переедет в Azure 4 ч.
Сверхтонкий iPhone 17 Slim получит всего одну тыльную камеру 4 ч.
AMD выпустила 4-нм мобильный процессор Ryzen 7 8745H — восемь ядер Zen 4, до 4,9 ГГц и без ИИ-движка XDNA 5 ч.