Сегодня 05 мая 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Представлена ИИ-модель YandexART 2.0 с поддержкой генерации текста на изображениях

«Яндекс» выпустил YandexART 2.0 — генератор картинок нового поколения. Нейросеть научилась создавать надписи на изображении и выдерживать на одной картинке сразу несколько стилей; объекты в пространстве и относительно друг друга теперь располагаются более естественно; а при создании изображений учитывается большее число деталей запроса.

 Источник изображений: «Яндекс»

Источник изображений: «Яндекс»

Отличительной особенностью YandexART 2.0 является гибридная архитектура нейросети, сочетающая черты свёрточной и трансформерной моделей. Свёрточная модель работает по принципу человеческого глаза, определяя ключевые признаки объекта, например, его форму, текстуру и края, но она ограничена в длине контекста, поэтому в длинных запросах ей помогает трансформер. Эта архитектура помогает YandexART 2.0 выдерживать несколько жанров в одном изображении — к примеру, она может изобразить анимешную этикетку на фотореалистичной бутылке лимонада.

Для обучения нейросети YandexART 2.0 использовались несколько сотен миллионов пар изображений и текстовых описаний к ним; более точное их соотношение обеспечила дополнительная VLM-модель, при помощи которой картинки анализировались и сопровождались подробными текстовыми описаниями. Массив обучающих данных был расширен за счёт нескольких сотен тысяч изображений с текстом — это помогло YandexART 2.0 дополнять картинки надписями латинскими буквами.

«Яндекс» также разработал собственную систему оценки качества работы для генератора изображений: новая модель выиграла у Midjourney v6.1 по критериям комплексности и эстетичности в 66 % и 58 % случаев соответственно, а также приблизилась к нему в аспекте релевантности запросам.

Бизнес-пользователи могут поработать с YandexART 2.0 на платформе Yandex Cloud — при помощи API можно интегрировать генератор изображений в любые приложения; есть возможность протестировать её работу в демонстрационном режиме для подбора оптимальных запросов. Корпоративные клиенты могут генерировать логотипы, иллюстрации для статей, презентаций или социальных сетей.

Визуальная нейросеть доступна также частным пользователям в веб-версии «Алисы» и собственном приложении виртуального помощника; владельцы бесплатных учётных записей могут запросить до пяти изображений в сутки, а у подписчиков опции «Алиса Про» такое ограничение отсутствует. С YandexART 2.0 можно создать аватарку для соцсетей, значок приложения, принт для футболки, открытку для друга или иллюстрацию для публикации.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Календарь релизов 4–10 мая: Dead as Disco, Mixtape, Motorslice и Beyond Enemy Lines — Vietnam 6 ч.
Нереалистичная нагрузка, завышенные ожидания и «глухое» руководство: ноябрьский релиз обернулся для создателей GTA VI жёсткими переработками 7 ч.
Forza Horizon 6 не опоздает на старт — игра «укатила» на золото 9 ч.
Инсайдеры: мультиплеерная Assassin's Creed Invictus в духе Fall Guys «просто ужасна», но Ubisoft не теряет надежды 11 ч.
Meta тестирует для Instagram метку для контента, созданного с помощью ИИ 11 ч.
«Станете самыми ненавистными людьми в Америке»: Маск угрожал руководству OpenAI перед началом судебных разбирательств 12 ч.
В открытый доступ попало 10 минут геймплея Awakening — потерянного сюжетного дополнения к Quake 4 12 ч.
Biohub Марка Цукерберга взялся ускорить лечение всех болезней с помощью ИИ-моделей клеток 16 ч.
Развитие ИИ замедляется из-за переизбытка бесполезных данных — их слишком много 16 ч.
Кооперативный шутер о приключениях роботов-ковбоев на Диком Западе стал новым хитом Steam — полмиллиона проданных копий Far Far West 16 ч.
Глава Nvidia заявил, что доля компании на китайском рынке ИИ-ускорителей упала до нуля 22 мин.
Хакер вывел из кошелька Grok токены на сумму $204 000, но потом добровольно вернул их 51 мин.
Новая статья: Обзор OnePlus Nord 6: смартфон среднего класса почти с флагманской мощью 4 ч.
Samsung, SK hynix и Micron начали разрабатывать DDR6 — первые модули ожидаются в продаже в 2028–2029 годах 5 ч.
Cerebras объявила о запуске IPO с оценкой капитализации в $26 млрд 5 ч.
Новая статья: Выбираем лучший игровой ноутбук до 100 000 рублей: сравнительное тестирование 7 интересных моделей 6 ч.
Минпромторг РФ рассказал, что ассортимент не пострадает от исключения Acer, Asus и других из списка параллельного импорта 7 ч.
В 9 из 10 умных колонок в России встроена «Яндекс Алиса» — россияне стали чаще выбирать дорогие модели 7 ч.
В Санкт-Петербурге тоже грядут отключения мобильного интернета и СМС, предупредили операторы 8 ч.
Intel переманила ветерана Qualcomm — курс на ИИ и робототехнику усиливается 10 ч.