Сегодня 09 сентября 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Alibaba представила нейросеть EMO — она оживляет портреты, заставляя их разговаривать и даже петь

Исследователи из Института интеллектуальных вычислений Alibaba разработали (PDF) систему искусственного интеллекта EMO (Emote Portrait Alive), которая анимирует статическое изображение человека, заставляя его реалистично говорить или петь.

 Источник изображения: youtube.com/@ai_beauty303

Источник изображения: youtube.com/@ai_beauty303

Система изображает реалистичную мимику и движения головы, точно соответствующие эмоциональным оттенкам звукового ряда, на основе которого генерируется анимация. «Традиционные методы зачастую неспособны передать полный спектр человеческих выражений лица и уникальность отдельных его стилей. Для решения этих проблемы мы предлагаем EMO — новый фреймворк, использующий подход прямого синтеза из аудио в видео, минуя потребность в промежуточных 3D-моделях или лицевых опорных точках», — пояснил глава группы разработчиков Линьжуй Тянь (Linrui Tian).

В основе системы EMO лежит диффузионная модель ИИ, зарекомендовавшая себя как способная генерировать реалистичные изображения. Исследователи обучили её на массиве данных, включающем более 250 часов видеозаписей «говорящей головы»: выступлений, фрагментов фильмов, телешоу и вокальных выступлений. В отличие от предыдущих методов, предполагающих создание трёхмерной модели или механизмов имитации человеческой мимики, EMO предполагает прямое преобразование звука в видеоряд. Это позволяет системе передавать мельчайшие движения и связанные с естественной речью особенности личности.

Авторы проекта утверждают, что EMO превосходит существующие методы по показателям качества видео, сохранения идентичности и выразительности. Исследователи опросили фокус-группу, и та показала, что созданные EMO видеоролики более естественны и эмоциональны, чем произведения других систем. Система создаёт анимацию не только на основе речи, но и с использованием звукового ряда с вокалом — она учитывает форму рта человека на оригинальном изображении, добавляет соответствующую мимику и синхронизирует движения с вокальной партией. Единственной связанной с EMO проблемой является вероятность злоупотребления этой технологией. Исследователи сообщают, что планируют изучить методы выявления созданных ИИ видеороликов.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Meta обвинили в помехах исследованиям о рисках для детей в Instagram и других платформах 4 мин.
Аналитики: за три дня в Hollow Knight: Silksong сыграло пять миллионов человек, и больше половины из них купили игру в Steam 8 мин.
В открытый доступ попало ещё больше геймплея отменённой Prey 2 35 мин.
AMD выпустила графический драйвер с поддержкой Borderlands 4 и Hell Is Us 2 ч.
«Захватывающие новости», эксклюзивные анонсы и трейлеры: в рамках Tokyo Game Show 2025 пройдут игровые презентации Xbox и PC Gaming Show 2 ч.
В Hollow Knight: Silksong нашли секретный чит-код, который делает игру ещё сложнее 2 ч.
Apple оштрафовали на 3,5 млн рублей за отказ удалить запрещённые в РФ материалы 2 ч.
Yandex.ru продолжит перенаправлять на сервисы VK ещё два года 2 ч.
В Непале отменили блокировку соцсетей после массовых протестов с 19 погибшими 3 ч.
Технология AMD FSR 4 заработала в большинстве игр с поддержкой FSR 3.1 3 ч.
Microsoft присоединилась к Всемирной ядерной ассоциации 48 мин.
Microsoft потратит почти $20 млрд на аренду ИИ-инфраструктуру у Nebius 52 мин.
Blackview представила флагманский защищённый смартфон Xplore 2 и другие новинки на IFA 2025 2 ч.
Доля Tesla на рынке электромобилей США рухнула до 38 % — это минимум с 2017 года 2 ч.
Sony готовит к запуску смартфон Xperia 10 VII — характеристики и изображения утекли в Сеть 2 ч.
Intel заверила, что до полного отделения производства чипов не дойдёт — но почти половину продать может 3 ч.
«Непоправимый ущерб»: Nintendo отсудила $2 млн за продажу взломанных Switch 3 ч.
Дональд Трамп пообещал IT-гигантам решить проблемы с энергоснабжением ЦОД 4 ч.
В России поступил в продажу флагманский смартфон Huawei Pura 80 5 ч.
Американские регуляторы не будут признавать результаты сертификации ввозимой в США электроники от нескольких китайских лабораторий 5 ч.