Сегодня 01 марта 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Google представила VLOGGER — ИИ для реалистичного «оживления» фотографий

Исследователи Google разработали VLOGGER — новый ИИ, создающий реалистичные видеоролики с говорящими, двигающимися и жестикулирующими людьми по одной фотографии. Помимо фотографии, можно добавить аудиодорожку, из которой ИИ создаст короткое видео говорящего человека с соответствующей мимикой и жестикуляцией.

 Источник изображения: everypixel.com

Источник изображения: everypixel.com

«В отличие от прошлых работ, наша модель не требует отдельного обучения для каждой фотографии и работает не только с лицами, создавая полноценное изображение человека, а не только лица или губ, что открывает новые возможности, необходимые для правильного воссоздания общающихся людей», — прокомментировали разработку исследователи Google.

Разработка Google может найти применение в самых разных областях человеческой деятельности, одна из которых — создание трёхмерных фотореалистичных аватаров для игр и виртуальной реальности. Возможно, некоторые актёры пожелают оцифровать себя и продавать трёхмерные модели киностудиям. Одним из основных применений технологии Google видит создание реалистичных чат-ботов, с которыми можно общаться как с живыми людьми.

«VLOGGER можно использовать как решение для презентаций, обучающих программ, общения в сетях с низкой пропускной способностью, в качестве виртуального рассказчика или интерфейса для текстового общения человека с компьютером», — рассказали исследователи.

 Источник изображения: enriccorona.github.io

Источник изображения: enriccorona.github.io

Не менее очевидно и возможное применение технологии для создания дипфейков, растущая популярность которых беспокоит законодателей и специалистов по безопасности со всего мира.

«Предложенная нами модель превосходит другие современные разработки по качеству картинки, сохранению личности человека и временной согласованности», — отметили исследователи.

Сейчас у VLOGGER есть объективные недостатки: видео получаются довольно короткими, фон статичен, люди не перемещаются в пространстве, их мимика и речь хоть и довольно реалистичны, но всё равно выдают работу ИИ. Тем не менее, нельзя не отметить заметный скачок в технологии анимации изображений.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Anthropic обжалует в суде своё внесение в «чёрный список» 3 ч.
Приложение Claude стало лидером рейтинга App Store из-за атаки американских властей на Anthropic 5 ч.
Новая статья: Yakuza Kiwami 3 & Dark Ties — вы чего наделали?! Рецензия 16 ч.
Хоррор-приключение Necrophosis получит расширенное издание и выйдет на консолях 22 ч.
YouTube запустил тест ИИ-ремиксов в Shorts: новые видео создаются из старых 22 ч.
Samsung отрезала опытным пользователям доступ к ряду ключевых инструментов в смартфонах Galaxy 22 ч.
Энтузиаст воссоздал Linux образца 1994 года с графическим интерфейсом в браузере 23 ч.
Google придумала, как защитить HTTPS от квантового взлома, не увеличивая размеры TLS-сертификатов 28-02 13:39
OpenAI уволила сотрудника за использование инсайдерской информации для ставок на рынках прогнозов 28-02 13:36
Ремейк Bloodborne от Bluepoint Games едва не стал реальностью — Sony проект одобрила, но был нюанс 28-02 11:20
Honor представила тонкий 14,6-дюймовый ноутбук MagicBook Pro 14 2026 на базе Intel Panther Lake-H 0 мин.
Отчёт TSMC показал, что теперь Nvidia является крупнейшим клиентом компании, а не Apple 8 ч.
Акции Nvidia за неделю подешевели на 7 %, несмотря на неплохой квартальный отчёт 9 ч.
Huawei продемонстрирует суперкомпьютерные системы в Барселоне на MWC 2026 10 ч.
Hyundai инвестирует более $6 млрд в ИИ ЦОД, роботов, водородную и солнечную энергетику 17 ч.
Китайцы нашли путь к радиационно-стойкой электронике — они сделали её прозрачной для излучения 18 ч.
Asus поделилась деталями ProArt GeForce RTX 5090 — минималистичный дизайн в стиле Founders Edition и заводской разгон GPU 18 ч.
НАТО вооружилось тараканами-киборгами — разведка станет незаметной, но уязвимой к тапку 20 ч.
LG оценила самый большой в мире 5K2K-монитор с частотой 240 Гц в $2000 22 ч.
JEDEC опубликовала спецификации флеш-памяти UFS 5.0 — до 10,8 Гбайт/с для самых быстрых смартфонов 22 ч.