Сегодня 30 декабря 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Стартап Black Forest Labs представил ИИ-генератор изображений FLUX.1 — он отлично справляется с прорисовкой рук человека

В конце прошлой недели стартап Black Forest Labs объявил о начале своей деятельности в сфере разработки генеративных нейросетей. Вместе с этим компания, созданная выходцами из Stability AI, представила семейство моделей генерации изображений по текстовому описанию под названием FLUX.1, которые претендуют на звание лучших в своём классе.

 Источник изображений: FLUX.1

Источник изображений: FLUX.1

Запуск FLUX.1 произошёл примерно через семь недель после того, как в середине июня Stability AI выпустила ИИ-генератор Stable Diffusion 3 Medium, который собрал много критики из-за невысокого качества при создании изображений, на которых есть люди. Пользователи активно делились в соцсетях результатами генерации алгоритма с искажёнными конечностями и телами людей.

Запуск Stable Diffusion 3 Medium последовал за уходом из Stability AI трёх ключевых сотрудников — Робина Ромбаха (Robin Rombach), Андреаса Блаттманна (Andreas Blattmann) и Доминика Лоренца (Dominik Lorenz). Именно они вместе с Патриком Эссером (Patrick Esser), который участвовал в разработке первой версии Stable Diffusion и с тех пор работал над разными ИИ-алгоритмами, а также другими инженерами, основали компанию Black Forest Lab.

На данный момент стартап представил три модели для генерации по текстовому описанию FLUX.1. ИИ-модель FLUX.1 pro представляет собой наиболее производительный генератор изображений, предназначенный для коммерческого использования через соответствующий API. Вместе с этим были выпущены FLUX.1 dev, доступная для некоммерческого использования, а также более лёгкая и быстрая FLUX.1 schnell (в переводе с немецкого — «быстрый» или «стремительный»).

Разработчики утверждают, что их ИИ-модели превосходят существующие аналоги, такие как Midjourney и DALL-E, по целому ряду показателей, включая качество создаваемых изображений и точность следования исходному описанию. В целом результаты генерации FLUX.1 сопоставимы с тем, что можно создать с помощью DALL-E 3 от OpenAI по точности следования описанию, и близки по фотореалистичности к Midjourney 6. При этом алгоритм явно более качественно работает по сравнению со Stable Diffusion XL, последним крупным релизом команды этих разработчиков, когда они ещё были частью Stability AI, не считая Stable Diffusion XL Turbo.

Модели Black Forest Lab построены на базе гибридной архитектуры, которая объединяет методы трансформации и диффузии, с масштабированием до 12 млрд параметров. Похоже, что такой подход делает нейросеть FLUX.1 способной качественно генерировать руки человека, что было слабым местом многих уже выпущенных на рынок аналогов. При этом разработчики не уточнили, на каких данных обучались модели FLUX.1.

Отметим, что Black Forest Lab уже привлекла финансирование в размере $31 млн. Желающим опробовать FLUX.1 в действии можно воспользоваться сервисами Fal.ai или Replicate.com, где придётся платить деньги для работы с алгоритмами.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Аналитики рассказали, чего ждать от GTA VI — рекорды продаж, но не спасение игровой индустрии 31 мин.
Nvidia завершали поглощение ИИ-стартапа Run:ai за $700 млн 55 мин.
Неофициальный русский дубляж Star Wars Jedi: Survivor от GamesVoice всё-таки вышел, но не полностью 2 ч.
Энтузиасты запустили современную ИИ-модель Llama на древнем ПК с Pentium II и Windows 98 3 ч.
Игроков заворожил геймплейный трейлер The Bustling World — амбициозной RPG в открытом мире Древнего Китая с безбрежной свободой выбора 6 ч.
Первый Office — бесплатно: FTC подозревает Microsoft в антиконкурентном поведении ради сохранения правительственных контрактов 6 ч.
Вышел новый геймплейный трейлер Operation: Black Mesa — фанатского ремейка Half-Life: Opposing Force и Blue Shift 7 ч.
ИИ будет манипулировать людьми, чтобы они принимали нужные решения 8 ч.
Годы идут, а игру продолжают покупать: продажи Stardew Valley достигли новой вершины 9 ч.
В YouTube появилась кнопка «Воспроизвести что-нибудь», но пока не у всех пользователей 9 ч.
Intel начала принимать заказы на непредставленные чипы Arrow Lake до официального анонса 58 мин.
В Китае представили прототипы самого быстрого в мире электропоезда 2 ч.
Облачные ИИ-стартапы вряд ли потеснят гиперскейлеров, но всё равно повлияют на них 5 ч.
Xiaomi представила компактный пауэрбанк на 20 000 мА·ч со встроенным кабелем USB-C за $22 5 ч.
Китайский ускоритель Moore Threads MTT X300 обеспечивает FP32-быстродействие до 14,4 Тфлопс 5 ч.
Moore Threads выпустила профессиональную видеокарту MTT X300 на мощном китайском GPU 5 ч.
Новая статья: Обзор смартфона Infinix ZERO Flip: раскладушка как средний класс 6 ч.
LG представила микроволновую печь с 27-дюймовым экраном для рекламы и развлечений 6 ч.
Вышли сверхпрочные смартфоны Blackview BV8200 и Oscal Pilot 1 и ноутбук Blackview AceBook 12 с большим тачпадом 7 ч.
Firefly представила серверы CSB1-N10 для создания ИИ-кластеров из одноплатных компьютеров 8 ч.