Сегодня 05 августа 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Стартап Black Forest Labs представил ИИ-генератор изображений FLUX.1 — он отлично справляется с прорисовкой рук человека

В конце прошлой недели стартап Black Forest Labs объявил о начале своей деятельности в сфере разработки генеративных нейросетей. Вместе с этим компания, созданная выходцами из Stability AI, представила семейство моделей генерации изображений по текстовому описанию под названием FLUX.1, которые претендуют на звание лучших в своём классе.

 Источник изображений: FLUX.1

Источник изображений: FLUX.1

Запуск FLUX.1 произошёл примерно через семь недель после того, как в середине июня Stability AI выпустила ИИ-генератор Stable Diffusion 3 Medium, который собрал много критики из-за невысокого качества при создании изображений, на которых есть люди. Пользователи активно делились в соцсетях результатами генерации алгоритма с искажёнными конечностями и телами людей.

Запуск Stable Diffusion 3 Medium последовал за уходом из Stability AI трёх ключевых сотрудников — Робина Ромбаха (Robin Rombach), Андреаса Блаттманна (Andreas Blattmann) и Доминика Лоренца (Dominik Lorenz). Именно они вместе с Патриком Эссером (Patrick Esser), который участвовал в разработке первой версии Stable Diffusion и с тех пор работал над разными ИИ-алгоритмами, а также другими инженерами, основали компанию Black Forest Lab.

На данный момент стартап представил три модели для генерации по текстовому описанию FLUX.1. ИИ-модель FLUX.1 pro представляет собой наиболее производительный генератор изображений, предназначенный для коммерческого использования через соответствующий API. Вместе с этим были выпущены FLUX.1 dev, доступная для некоммерческого использования, а также более лёгкая и быстрая FLUX.1 schnell (в переводе с немецкого — «быстрый» или «стремительный»).

Разработчики утверждают, что их ИИ-модели превосходят существующие аналоги, такие как Midjourney и DALL-E, по целому ряду показателей, включая качество создаваемых изображений и точность следования исходному описанию. В целом результаты генерации FLUX.1 сопоставимы с тем, что можно создать с помощью DALL-E 3 от OpenAI по точности следования описанию, и близки по фотореалистичности к Midjourney 6. При этом алгоритм явно более качественно работает по сравнению со Stable Diffusion XL, последним крупным релизом команды этих разработчиков, когда они ещё были частью Stability AI, не считая Stable Diffusion XL Turbo.

Модели Black Forest Lab построены на базе гибридной архитектуры, которая объединяет методы трансформации и диффузии, с масштабированием до 12 млрд параметров. Похоже, что такой подход делает нейросеть FLUX.1 способной качественно генерировать руки человека, что было слабым местом многих уже выпущенных на рынок аналогов. При этом разработчики не уточнили, на каких данных обучались модели FLUX.1.

Отметим, что Black Forest Lab уже привлекла финансирование в размере $31 млн. Желающим опробовать FLUX.1 в действии можно воспользоваться сервисами Fal.ai или Replicate.com, где придётся платить деньги для работы с алгоритмами.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Xbox анонсировала публичное демо Ark 2 для gamescom 2024, но потом взяла свои слова обратно 23 мин.
Создатели Kingdom Come: Deliverance 2 раскрыли планы на gamescom 2024 — новый тизер, 20 минут геймплея и публичное демо 2 ч.
Новые механики, лошадь и смузи: пятиминутный геймплейный трейлер The Legend of Zelda: Echoes of Wisdom 3 ч.
Стартап Black Forest Labs представил ИИ-генератор изображений FLUX.1 — он отлично справляется с прорисовкой рук человека 3 ч.
СУБД на выделенном облачном сервере: Secletel представил новое DBaaS-решение 4 ч.
«Так много стремлений и так мало времени»: Larian рассказала, чего ждать от двух новых RPG после Baldur’s Gate 3 5 ч.
Программу вознаграждений TikTok Lite закроют в ЕС — она нарушает закон DSA 6 ч.
Служба каталогов ALD Pro получила сертификат ФСТЭК России по 4-му уровню доверия 7 ч.
В России обнаружен Android-троян для точечного шпионажа 7 ч.
NVIDIA купила Run:ai, чтобы «похоронить» наработки стартапа, подозревает Минюст США 9 ч.
Учёные создали летающего робота, вдохновлённого жуком-носорогом — он машет крыльями в полёте и складывает их при отдыхе 31 мин.
300 км пробега за 5 минут: представлена сверхбыстрая зарядка XPeng S5 мощностью 800 кВт 2 ч.
Xiaomi выпустила 27-дюймовый 4K-монитор Redmi Monitor A27U всего за $169 3 ч.
GDS Holdings ищет $1 млрд на развитие ЦОД за пределами Китая 3 ч.
Поставки дисплеев для AR/VR-гарнитур достигнут 37 млн единиц к 2030 году 3 ч.
Норвежские операторы ЦОД готовятся к отмене налоговых льгот и задумаются над повышением энергоэффективности объектов 5 ч.
Представлен смартфон Infinix Note 40X 5G на чипе Dimensity 6300 по цене от $167 5 ч.
Lenovo выпустила гибридный планшет ThinkBook Plus Gen 5 Hybrid с чипами Intel и Qualcomm 5 ч.
Apple готовит к выпуску доступные смарт-часы Watch SE с пластиковым корпусом для детей 7 ч.
Honor готовится к выходу на биржу и получает всё больше поддержки от властей Шэньчжэня 8 ч.