Сегодня 02 февраля 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Google представила VLOGGER — ИИ для реалистичного «оживления» фотографий

Исследователи Google разработали VLOGGER — новый ИИ, создающий реалистичные видеоролики с говорящими, двигающимися и жестикулирующими людьми по одной фотографии. Помимо фотографии, можно добавить аудиодорожку, из которой ИИ создаст короткое видео говорящего человека с соответствующей мимикой и жестикуляцией.

 Источник изображения: everypixel.com

Источник изображения: everypixel.com

«В отличие от прошлых работ, наша модель не требует отдельного обучения для каждой фотографии и работает не только с лицами, создавая полноценное изображение человека, а не только лица или губ, что открывает новые возможности, необходимые для правильного воссоздания общающихся людей», — прокомментировали разработку исследователи Google.

Разработка Google может найти применение в самых разных областях человеческой деятельности, одна из которых — создание трёхмерных фотореалистичных аватаров для игр и виртуальной реальности. Возможно, некоторые актёры пожелают оцифровать себя и продавать трёхмерные модели киностудиям. Одним из основных применений технологии Google видит создание реалистичных чат-ботов, с которыми можно общаться как с живыми людьми.

«VLOGGER можно использовать как решение для презентаций, обучающих программ, общения в сетях с низкой пропускной способностью, в качестве виртуального рассказчика или интерфейса для текстового общения человека с компьютером», — рассказали исследователи.

 Источник изображения: enriccorona.github.io

Источник изображения: enriccorona.github.io

Не менее очевидно и возможное применение технологии для создания дипфейков, растущая популярность которых беспокоит законодателей и специалистов по безопасности со всего мира.

«Предложенная нами модель превосходит другие современные разработки по качеству картинки, сохранению личности человека и временной согласованности», — отметили исследователи.

Сейчас у VLOGGER есть объективные недостатки: видео получаются довольно короткими, фон статичен, люди не перемещаются в пространстве, их мимика и речь хоть и довольно реалистичны, но всё равно выдают работу ИИ. Тем не менее, нельзя не отметить заметный скачок в технологии анимации изображений.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
ViewSonic выпустила 23,8-дюймовый игровой FHD-монитор с частотой 144 Гц и стоимостью всего $55 6 ч.
Квантовая физика помогла создать сверхточный атомный термометр 7 ч.
Galax выпустила GeForce RTX 5080 HOF OC LAB Plus-X для экстремального разгона 8 ч.
Илон Маск заявил о готовности Tesla выпустить 10 000 роботов Optimus за год 11 ч.
Мировой рынок смартфонов впервые за два года показал рост, а средняя цена смартфона достигла $365 11 ч.
Apple согласилась выплатить компенсации владельцам вздувшихся Apple Watch 13 ч.
Nvidia, Valve, Meta и Comcast начали развёртывание в США нелагающего интернета по стандарту L4S 14 ч.
В США создали стенд для тестирования солнечных парусов, которые доставят зонды к Альфе-Центавра и дальше 14 ч.
Apple закрыла проект по созданию лёгких очков дополненной реальности с сопряжением с Mac 15 ч.
Самый быстрый инференс DeepSeek R1 в мире: ИИ-платформа Cerebras снова поставила рекорд производительности 15 ч.