Сегодня 26 апреля 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

«Сбер» запустил нейросеть Kandinsky 2.1 — она генерирует изображения по описанию на русском и других языках

Разработчики из «Сбера» представили новую версию нейросети Kandinsky, которая является отечественным аналогом популярного алгоритма Midjourney. Генеративная модель Kandinsky 2.1 может использоваться для создания высококачественных изображений на основе текстового описания, дорисовки картинок и др. Нейросеть доступна всем желающим

 Источник изображений: sberbank.com

Источник изображений: sberbank.com

«Новая генеративная модель "Сбера" — Kandinsky 2.1 — способна всего за несколько секунд создавать высококачественные изображения по текстовому описанию на естественном языке. Она также может смешивать несколько рисунков, изменять их по текстовому описанию, генерировать изображения, похожие на заданное, дорисовывать недостающие части картинки и формировать изображения в режиме бесконечного полотна (inpainting/outpainting). Модель понимает запросы на 101 языке (включая русский и английский) и умеет рисовать в различных стилях», — сказано в сообщении «Сбера».

Разработкой и обучением алгоритма занимались специалисты Sber AI совместно с учёными из Института искусственного интеллекта AIRI, задействовав для этого объединённый датасет Sber AI и SberDevices. Модель Kandinsky 2.1 является усовершенствованной версией предыдущей версии алгоритма, которая была дополнительно обучена на 170 млн пар «текст — изображение» высокого разрешения. В дополнение к этому алгоритм дополнительно обучался на отдельном датасете из двух миллионов пар качественных изображений. Этот датасет состоял из изображений с описаниями в сложных для нейросетей областях, таких как тексты и лица людей.

Представленный алгоритм усовершенствован за счёт новой модели автоэнкодера, используемой в том числе в качестве декодера векторных представлений изображений. За счёт этого удалось кардинально улучшить генерацию изображений в высоком разрешении. Модель Kandinsky 2.1 содержит 3,3 млрд параметров, что значительно больше по сравнению с 2 млрд параметров модели Kandinsky 2.0. Алгоритм использует закодированное текстовое описание и специальное представление изображения моделью CLIP. Он способен визуализировать любой контент и может применяться в разных отраслях.

Пользователи могут оценить возможности Kandinsky 2.1 на промо-странице, а также воспользовавшись командой «Запусти художника» на устройствах Sber, в мобильном приложении «Салют» и на платформе ML Space. Ещё нейросеть доступна через бота в Telegram. Правда, при попытке воспользоваться ею, через несколько минут появилось сообщение: «Произошла ошибка при работе модели:( Попробуй, пожалуйста, еще раз».

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Рекламные доходы YouTube в первом квартале выросли на 21 % до $8,1 млрд 52 мин.
Инсайдер: Capcom отложила релиз Resident Evil 9, но в 2025 году может выйти другая игра серии 4 ч.
Звёздный отчёт Alphabet вдохновил инвесторов: у компании быстро растёт выручка и рентабельность 4 ч.
Microsoft получает всё больше выгоды от ИИ — компания показала сильный квартальный отчёт 6 ч.
Газировка с Copilot: Microsoft получила миллиардный контракт на обеспечение Coca-Cola облачными и ИИ-сервисами 6 ч.
Продюсер «Смуты» раскрыл, что добавят в игру с обновлениями, и подтвердил работу над продолжением 6 ч.
ИИ-приложение Google Gemini стало совместимо с Android 10 и Android 11 7 ч.
В США вернули сетевой нейтралитет 8 ч.
Alphabet объявила о первых в своей истории дивидендах, акции выросли в цене на 11,4 % 8 ч.
Младенец-экстрасенс против секретной корпорации: соавторы Before Your Eyes анонсировали сюжетное приключение Goodnight Universe 8 ч.
Realme представила 5G-версию 125-долларового смартфона C65 на чипе Dimensity 6300 33 мин.
Продажи Surface и Xbox снижаются, но Microsoft компенсирует потери играми Activision Blizzard 38 мин.
Зонд «Психея» связался с Землёй по лазерному лучу с расстояния 226 млн км — скорость достигла 25 Мбит/с 47 мин.
Moondrop выпустила аудиофильский смартфон MIAD 01 с двумя ЦАП Cirrus Logic 54 мин.
UserGate объявила о расширении портфеля услуг и продуктов, а также запуске центра мониторинга ИБ 3 ч.
CATL представила LFP-батареи Shenxing Plus, на которых электромобиль сможет проехать 1000 км 3 ч.
IBM представила СХД FlashSystem 5300 и подписку Storage Assurance 4 ч.
Выручка Western Digital выросла на 23 %, но число проданных жёстких дисков продолжает падать 4 ч.
«Закон о чипах» сработал: строительство полупроводниковых заводов в США активизировалось в 15 раз 4 ч.
Blackview представила BL9000 Pro — неубиваемый смартфон со встроенным тепловизором 6 ч.