Сегодня 20 мая 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Alibaba представила нейросеть EMO — она оживляет портреты, заставляя их разговаривать и даже петь

Исследователи из Института интеллектуальных вычислений Alibaba разработали (PDF) систему искусственного интеллекта EMO (Emote Portrait Alive), которая анимирует статическое изображение человека, заставляя его реалистично говорить или петь.

 Источник изображения: youtube.com/@ai_beauty303

Источник изображения: youtube.com/@ai_beauty303

Система изображает реалистичную мимику и движения головы, точно соответствующие эмоциональным оттенкам звукового ряда, на основе которого генерируется анимация. «Традиционные методы зачастую неспособны передать полный спектр человеческих выражений лица и уникальность отдельных его стилей. Для решения этих проблемы мы предлагаем EMO — новый фреймворк, использующий подход прямого синтеза из аудио в видео, минуя потребность в промежуточных 3D-моделях или лицевых опорных точках», — пояснил глава группы разработчиков Линьжуй Тянь (Linrui Tian).

В основе системы EMO лежит диффузионная модель ИИ, зарекомендовавшая себя как способная генерировать реалистичные изображения. Исследователи обучили её на массиве данных, включающем более 250 часов видеозаписей «говорящей головы»: выступлений, фрагментов фильмов, телешоу и вокальных выступлений. В отличие от предыдущих методов, предполагающих создание трёхмерной модели или механизмов имитации человеческой мимики, EMO предполагает прямое преобразование звука в видеоряд. Это позволяет системе передавать мельчайшие движения и связанные с естественной речью особенности личности.

Авторы проекта утверждают, что EMO превосходит существующие методы по показателям качества видео, сохранения идентичности и выразительности. Исследователи опросили фокус-группу, и та показала, что созданные EMO видеоролики более естественны и эмоциональны, чем произведения других систем. Система создаёт анимацию не только на основе речи, но и с использованием звукового ряда с вокалом — она учитывает форму рта человека на оригинальном изображении, добавляет соответствующую мимику и синхронизирует движения с вокальной партией. Единственной связанной с EMO проблемой является вероятность злоупотребления этой технологией. Исследователи сообщают, что планируют изучить методы выявления созданных ИИ видеороликов.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Microsoft приоткрыла исходный код WSL — подсистемы для запуска Linux-приложений в Windows 3 ч.
GTX 750 Ti для игры уже не хватит: Ubisoft объявила системные требования Rainbow Six Siege X 4 ч.
Nvidia выпустила драйвер с поддержкой GeForce RTX 5060 6 ч.
Календарь релизов — 19–25 мая: RoadCraft, Deliver At All Costs и Tainted Grail: The Fall of Avalon 6 ч.
Преступники пришли за криптоэлитой в реальном мире — участились похищения, нападения и запугивания 7 ч.
Microsoft «провалила» облачную реформу в Европе 8 ч.
«До сих пор мурашки от музыки»: официальный трейлер в честь 10-летия The Witcher 3: Wild Hunt подарил фанатам мощный заряд ностальгии 9 ч.
HPE предложила клиентам VMware новые решения с Morpheus VM Essentials 12 ч.
Журналисты выяснили, какие функции Nintendo Switch 2 будут недоступны игрокам в России 13 ч.
«Самое позорное, что я видел от этой компании»: разработчики Star Citizen возмутили игроков анонсом геймплейных апгрейдов за реальные деньги 14 ч.
Asus представила игровые ноутбуки с GeForce RTX 5060 — на $300–400 дешевле моделей с RTX 5070 3 ч.
Новая статья: ИИ-агенты: фас, профиль, пароли, явки 3 ч.
NVIDIA построит на Тайване новую штаб-квартиру и развернёт два ИИ-суперкомпьютера 3 ч.
Asus представила видеокарты ProArt GeForce RTX 5080 с отделкой под дерево, USB-C и слотом M.2 4 ч.
Asus представила блоки питания Pro WS мощностью до 3000 Вт — этого хватит на четыре RTX 5090 5 ч.
Gigabyte показала быстрые игровые мониторы на панелях QD-OLED и IPS на выставке Computex 2025 5 ч.
Разработчик термоядерных реакторов Commonwealth Fusion Systems привлёк более $1 млрд благодаря неизвестному гиперскейлеру 5 ч.
MSI представила свою первую портативную консоль на чипе AMD — это Claw A8 с мощным Ryzen Z2 Extreme 6 ч.
Asus, HP, Dell и другие партнёры Nvidia представили настольные ИИ-суперкомпьютеры DGX Spark и рабочие станции DGX Station 7 ч.
Asus представила видеокарты, материнские платы и корпуса с поддержкой BTF 2.5 для сборки «чистых» ПК 8 ч.