Сегодня 02 января 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → black forest lab

Стартап Black Forest Labs представил ИИ-генератор изображений FLUX.1 — он отлично справляется с прорисовкой рук человека

В конце прошлой недели стартап Black Forest Labs объявил о начале своей деятельности в сфере разработки генеративных нейросетей. Вместе с этим компания, созданная выходцами из Stability AI, представила семейство моделей генерации изображений по текстовому описанию под названием FLUX.1, которые претендуют на звание лучших в своём классе.

 Источник изображений: FLUX.1

Источник изображений: FLUX.1

Запуск FLUX.1 произошёл примерно через семь недель после того, как в середине июня Stability AI выпустила ИИ-генератор Stable Diffusion 3 Medium, который собрал много критики из-за невысокого качества при создании изображений, на которых есть люди. Пользователи активно делились в соцсетях результатами генерации алгоритма с искажёнными конечностями и телами людей.

Запуск Stable Diffusion 3 Medium последовал за уходом из Stability AI трёх ключевых сотрудников — Робина Ромбаха (Robin Rombach), Андреаса Блаттманна (Andreas Blattmann) и Доминика Лоренца (Dominik Lorenz). Именно они вместе с Патриком Эссером (Patrick Esser), который участвовал в разработке первой версии Stable Diffusion и с тех пор работал над разными ИИ-алгоритмами, а также другими инженерами, основали компанию Black Forest Lab.

На данный момент стартап представил три модели для генерации по текстовому описанию FLUX.1. ИИ-модель FLUX.1 pro представляет собой наиболее производительный генератор изображений, предназначенный для коммерческого использования через соответствующий API. Вместе с этим были выпущены FLUX.1 dev, доступная для некоммерческого использования, а также более лёгкая и быстрая FLUX.1 schnell (в переводе с немецкого — «быстрый» или «стремительный»).

Разработчики утверждают, что их ИИ-модели превосходят существующие аналоги, такие как Midjourney и DALL-E, по целому ряду показателей, включая качество создаваемых изображений и точность следования исходному описанию. В целом результаты генерации FLUX.1 сопоставимы с тем, что можно создать с помощью DALL-E 3 от OpenAI по точности следования описанию, и близки по фотореалистичности к Midjourney 6. При этом алгоритм явно более качественно работает по сравнению со Stable Diffusion XL, последним крупным релизом команды этих разработчиков, когда они ещё были частью Stability AI, не считая Stable Diffusion XL Turbo.

Модели Black Forest Lab построены на базе гибридной архитектуры, которая объединяет методы трансформации и диффузии, с масштабированием до 12 млрд параметров. Похоже, что такой подход делает нейросеть FLUX.1 способной качественно генерировать руки человека, что было слабым местом многих уже выпущенных на рынок аналогов. При этом разработчики не уточнили, на каких данных обучались модели FLUX.1.

Отметим, что Black Forest Lab уже привлекла финансирование в размере $31 млн. Желающим опробовать FLUX.1 в действии можно воспользоваться сервисами Fal.ai или Replicate.com, где придётся платить деньги для работы с алгоритмами.


window-new
Soft
Hard
Тренды 🔥
Не робот? Убей трёх монстров! — тест CAPTCHA заменили игрой в Doom 41 мин.
Крупнейшие финансовые организации России завершили переход на отечественное ПО, но не всё так просто 2 ч.
В Telegram появились уникальные подарки, фильтры в поиске, сторонняя верификация и сканер QR-кодов 2 ч.
Малайзия ужесточила регулирование соцсетей — X и Google остались без лицензий 4 ч.
OpenAI не выполнила обещание по созданию инструмента для защиты авторских прав к 2025 году 14 ч.
Epic Games Store начал 2025 год с раздачи Kingdom Come: Deliverance — она продлится всего сутки 23 ч.
Black Myth: Wukong стала лучшей игрой года по версии пользователей Steam — итоги The 2024 Steam Awards 31-12 21:58
«Дорога была долгой, но конец уже близок»: разработка Skyblivion продвинулась как никогда далеко 31-12 21:23
«Отличный новогодний подарок»: игроки остались в восторге от последней тайной раздачи Epic Games Store в 2024 году 31-12 20:09
Ставки как никогда высоки: создатель BioShock объяснил, почему Judas создаётся так долго 31-12 19:16
Суммарное состояние богатейших людей мира превысило $10 трлн благодаря росту техногигантов 59 мин.
MSI представила первый в мире 27-дюймовый игровой монитор с экраном QD-OLED 4K 240 Гц и DisplayPort 2.1a 2 ч.
Nvidia стала лидером по приросту капитализации в прошлом году, увеличив её на $2 трлн 2 ч.
Apple предположительно прекратила производство AR-гарнитуры Vision Pro 2 ч.
Учёные на шаг приблизились к разгадке источника загадочных радиосигналов из глубин Вселенной 2 ч.
ИИ останется драйвером роста полупроводниковой отрасли в 2025 году, но политика США может принести сюрпризы 3 ч.
Nvidia в прошлом году инвестировала $1 млрд в компании, связанные с ИИ 3 ч.
От американских санкций пострадали Apple и Samsung — их китайскому поставщику приходится продавать заводы 3 ч.
Apple намерена задержаться с переходом на 2-нм техпроцесс до 2026 года 4 ч.
SpaceX в прошлом году запустила больше ракет, чем все остальные страны вместе взятые 4 ч.