Сегодня 23 мая 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Alibaba представила нейросеть EMO — она оживляет портреты, заставляя их разговаривать и даже петь

Исследователи из Института интеллектуальных вычислений Alibaba разработали (PDF) систему искусственного интеллекта EMO (Emote Portrait Alive), которая анимирует статическое изображение человека, заставляя его реалистично говорить или петь.

 Источник изображения: youtube.com/@ai_beauty303

Источник изображения: youtube.com/@ai_beauty303

Система изображает реалистичную мимику и движения головы, точно соответствующие эмоциональным оттенкам звукового ряда, на основе которого генерируется анимация. «Традиционные методы зачастую неспособны передать полный спектр человеческих выражений лица и уникальность отдельных его стилей. Для решения этих проблемы мы предлагаем EMO — новый фреймворк, использующий подход прямого синтеза из аудио в видео, минуя потребность в промежуточных 3D-моделях или лицевых опорных точках», — пояснил глава группы разработчиков Линьжуй Тянь (Linrui Tian).

В основе системы EMO лежит диффузионная модель ИИ, зарекомендовавшая себя как способная генерировать реалистичные изображения. Исследователи обучили её на массиве данных, включающем более 250 часов видеозаписей «говорящей головы»: выступлений, фрагментов фильмов, телешоу и вокальных выступлений. В отличие от предыдущих методов, предполагающих создание трёхмерной модели или механизмов имитации человеческой мимики, EMO предполагает прямое преобразование звука в видеоряд. Это позволяет системе передавать мельчайшие движения и связанные с естественной речью особенности личности.

Авторы проекта утверждают, что EMO превосходит существующие методы по показателям качества видео, сохранения идентичности и выразительности. Исследователи опросили фокус-группу, и та показала, что созданные EMO видеоролики более естественны и эмоциональны, чем произведения других систем. Система создаёт анимацию не только на основе речи, но и с использованием звукового ряда с вокалом — она учитывает форму рта человека на оригинальном изображении, добавляет соответствующую мимику и синхронизирует движения с вокальной партией. Единственной связанной с EMO проблемой является вероятность злоупотребления этой технологией. Исследователи сообщают, что планируют изучить методы выявления созданных ИИ видеороликов.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
С 12 июня товары и услуги в ботах Telegram можно будет покупать только за Telegram Stars 29 мин.
ГК Softline открыла представительство в ОАЭ для выхода на рынки Ближнего Востока 2 ч.
Relic впервые за 20 лет вновь стала независимой — разработчики Company of Heroes и Warhammer 40,000: Dawn of War «вернутся к корням» 9 ч.
Mozilla Firefox получит вертикальные вкладки, группы вкладок и другие масштабные улучшения 9 ч.
Selectel создаст собственную отечественную ОС на базе Linux-дистрибутива Debian 12 и выйдет на рынок инфраструктурного ПО 11 ч.
Студия-разработчик Helldivers 2 нацелилась «стать следующей FromSoftware или Blizzard» 12 ч.
Google выпустила обновление, устраняющее шесть критических уязвимостей в Chrome 12 ч.
Activision начала рекламную кампанию новой Call of Duty — первый тизер Black Ops 6 12 ч.
Пионер компьютерных технологий Гордон Белл умер в возрасте 89 лет 13 ч.
В Twitch появилась фильтрация контента — пользователи могут скрыть трансляции на «сексуализированные темы» 13 ч.
В следующем месяце Nvidia осуществит дробление акций по схеме «10 к 1» 2 ч.
Взлетевшая более чем в пять раз выручка Nvidia в серверном сегменте способствовала росту акций до уровня более $1000 3 ч.
Новый Microsoft Surface с чипом Qualcomm Snapdragon X Elite показал отличные результаты, но с оговорками 5 ч.
Новая статья: Обзор смартфона HUAWEI Pura 70: флагман по справедливой цене 7 ч.
Новая статья: Обзор игрового 360 Гц WQHD-монитора MSI MPG 271QRX QD-OLED: теперь на равных 9 ч.
В июле Atos продаст свои активы и определится с планом проведения реструктуризации 10 ч.
В России активно изучают идею создания отечественной игровой приставки, заявили в Минпромторге 11 ч.
На всех российских авиалайнерах к 2028 году появится Wi-Fi — также к спутниковому интернету подключат поезда РЖД 11 ч.
Google обогнала AMD на рынке процессоров для ЦОД и вот-вот догонит Intel 11 ч.
Первый полёт Boeing Starliner с астронавтами отложили на неопределённый срок 13 ч.