Сегодня 03 мая 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Alibaba представила нейросеть EMO — она оживляет портреты, заставляя их разговаривать и даже петь

Исследователи из Института интеллектуальных вычислений Alibaba разработали (PDF) систему искусственного интеллекта EMO (Emote Portrait Alive), которая анимирует статическое изображение человека, заставляя его реалистично говорить или петь.

 Источник изображения: youtube.com/@ai_beauty303

Источник изображения: youtube.com/@ai_beauty303

Система изображает реалистичную мимику и движения головы, точно соответствующие эмоциональным оттенкам звукового ряда, на основе которого генерируется анимация. «Традиционные методы зачастую неспособны передать полный спектр человеческих выражений лица и уникальность отдельных его стилей. Для решения этих проблемы мы предлагаем EMO — новый фреймворк, использующий подход прямого синтеза из аудио в видео, минуя потребность в промежуточных 3D-моделях или лицевых опорных точках», — пояснил глава группы разработчиков Линьжуй Тянь (Linrui Tian).

В основе системы EMO лежит диффузионная модель ИИ, зарекомендовавшая себя как способная генерировать реалистичные изображения. Исследователи обучили её на массиве данных, включающем более 250 часов видеозаписей «говорящей головы»: выступлений, фрагментов фильмов, телешоу и вокальных выступлений. В отличие от предыдущих методов, предполагающих создание трёхмерной модели или механизмов имитации человеческой мимики, EMO предполагает прямое преобразование звука в видеоряд. Это позволяет системе передавать мельчайшие движения и связанные с естественной речью особенности личности.

Авторы проекта утверждают, что EMO превосходит существующие методы по показателям качества видео, сохранения идентичности и выразительности. Исследователи опросили фокус-группу, и та показала, что созданные EMO видеоролики более естественны и эмоциональны, чем произведения других систем. Система создаёт анимацию не только на основе речи, но и с использованием звукового ряда с вокалом — она учитывает форму рта человека на оригинальном изображении, добавляет соответствующую мимику и синхронизирует движения с вокальной партией. Единственной связанной с EMO проблемой является вероятность злоупотребления этой технологией. Исследователи сообщают, что планируют изучить методы выявления созданных ИИ видеороликов.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Соцсеть X изменит механизм работы блокировки — нынешний не нравится Маску 10 мин.
Google потребовала отклонить чрезмерные и небезопасные требования Epic Games о реформах в «Play Маркет» 14 мин.
Apple разрешит пользователям в ЕС устанавливать приложения на iPad в обход App Store осенью 23 мин.
«За бюрократию!»: игроки Helldivers 2 в Steam взбунтовались против требования привязки аккаунта PlayStation 59 мин.
Microsoft закрыла полиции США доступ к ИИ, который использовали для распознавания лиц 2 ч.
Блокировка TikTok в США ускорит распространение «сплинтернета» 2 ч.
Bethesda случайно подтвердила теорию фанатов о дополнении Shattered Space к Starfield 2 ч.
Глава Apple уверен, что ИИ будет работать на iPhone лучше, чем у других 3 ч.
Microsoft обнаружила в Android опасный баг, позволяющий взламывать смартфоны через приложения 3 ч.
VK, «Сбер» и «Яндекс» не договорились о совместной разработке российской ОС на базе Android 3 ч.
Казахстан намерен развивать дата-центры в сотрудничестве с Google и Microsoft 33 мин.
В Краснодаре запустят производство китайских сельскохозяйственных дронов Jtilep 36 мин.
Представлен смартфон Vivo Y100 — Snapdragon 685, AMOLED-дисплей и быстрая 80-Вт зарядка 40 мин.
Hesai разработала лидар, который не портит внешний вид автомобиля 2 ч.
В Чили открылась самая высокогорную обсерватория в мире 2 ч.
Акцент на ИИ: маркетинговые материалы смартфона Google Pixel 8a утекли за полторы недели до анонса 3 ч.
Житель Флориды отправится на шесть лет в тюрьму за поставку поддельного оборудования Cisco на $1 млрд, в том числе Пентагону 3 ч.
Выручка Apple от смартфонов в Китае выросла вопреки падению продаж iPhone 3 ч.
Результаты AMD в I квартале оправдали прогнозы аналитиков, но акции упали — инвесторы ожидают большего роста 4 ч.
Удаление Huawei и ZTE из сетей связи США под угрозой срыва из-за нехватки финансирования 5 ч.