Сегодня 10 мая 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Google представила VLOGGER — ИИ для реалистичного «оживления» фотографий

Исследователи Google разработали VLOGGER — новый ИИ, создающий реалистичные видеоролики с говорящими, двигающимися и жестикулирующими людьми по одной фотографии. Помимо фотографии, можно добавить аудиодорожку, из которой ИИ создаст короткое видео говорящего человека с соответствующей мимикой и жестикуляцией.

 Источник изображения: everypixel.com

Источник изображения: everypixel.com

«В отличие от прошлых работ, наша модель не требует отдельного обучения для каждой фотографии и работает не только с лицами, создавая полноценное изображение человека, а не только лица или губ, что открывает новые возможности, необходимые для правильного воссоздания общающихся людей», — прокомментировали разработку исследователи Google.

Разработка Google может найти применение в самых разных областях человеческой деятельности, одна из которых — создание трёхмерных фотореалистичных аватаров для игр и виртуальной реальности. Возможно, некоторые актёры пожелают оцифровать себя и продавать трёхмерные модели киностудиям. Одним из основных применений технологии Google видит создание реалистичных чат-ботов, с которыми можно общаться как с живыми людьми.

«VLOGGER можно использовать как решение для презентаций, обучающих программ, общения в сетях с низкой пропускной способностью, в качестве виртуального рассказчика или интерфейса для текстового общения человека с компьютером», — рассказали исследователи.

 Источник изображения: enriccorona.github.io

Источник изображения: enriccorona.github.io

Не менее очевидно и возможное применение технологии для создания дипфейков, растущая популярность которых беспокоит законодателей и специалистов по безопасности со всего мира.

«Предложенная нами модель превосходит другие современные разработки по качеству картинки, сохранению личности человека и временной согласованности», — отметили исследователи.

Сейчас у VLOGGER есть объективные недостатки: видео получаются довольно короткими, фон статичен, люди не перемещаются в пространстве, их мимика и речь хоть и довольно реалистичны, но всё равно выдают работу ИИ. Тем не менее, нельзя не отметить заметный скачок в технологии анимации изображений.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Новая статья: despelote — го-о-о-о-о-о-о-о-о-о-ол! Рецензия 8 ч.
Разработчики ремейка «Готики» прокачали демоверсию на основе отзывов игроков — «Пролог Нираса» получил крупное обновление 12 ч.
Доход Apple App Store в минувшем году оценили более чем в $10 миллиардов — и это только в США 14 ч.
Killing Floor 3 выйдет на четыре месяца позже обещанного — объявлена новая дата релиза 15 ч.
Сэм Альтман переобулся и теперь утверждает, что госрегулирование ИИ поставит крест на лидерстве США 18 ч.
«Мы явно перестарались»: разработчикам Clair Obscur: Expedition 33 пришлось ослабить умение, которое позволяло наносить миллиарды единиц урона 20 ч.
Доставка прибудет по расписанию: курьерский экшен Death Stranding 2: On the Beach ушёл на золото за полтора месяца до релиза 20 ч.
В Telegram добавились маркетплейс подарков, публикация нескольких историй сразу и автоматический перевод в каналах 21 ч.
«Лучшая карточная игра с RPG-элементами»: с 2022 года пользователи The Witcher 3: Wild Hunt наиграли в «Гвинт» более 458 миллионов партий 21 ч.
2K подтвердила системные требования Mafia: The Old Country — для комфортной игры понадобится RTX 3080 Ti и 32 Гбайт ОЗУ 22 ч.