Сегодня 19 сентября 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Стартап Black Forest Labs представил ИИ-генератор изображений FLUX.1 — он отлично справляется с прорисовкой рук человека

В конце прошлой недели стартап Black Forest Labs объявил о начале своей деятельности в сфере разработки генеративных нейросетей. Вместе с этим компания, созданная выходцами из Stability AI, представила семейство моделей генерации изображений по текстовому описанию под названием FLUX.1, которые претендуют на звание лучших в своём классе.

 Источник изображений: FLUX.1

Источник изображений: FLUX.1

Запуск FLUX.1 произошёл примерно через семь недель после того, как в середине июня Stability AI выпустила ИИ-генератор Stable Diffusion 3 Medium, который собрал много критики из-за невысокого качества при создании изображений, на которых есть люди. Пользователи активно делились в соцсетях результатами генерации алгоритма с искажёнными конечностями и телами людей.

Запуск Stable Diffusion 3 Medium последовал за уходом из Stability AI трёх ключевых сотрудников — Робина Ромбаха (Robin Rombach), Андреаса Блаттманна (Andreas Blattmann) и Доминика Лоренца (Dominik Lorenz). Именно они вместе с Патриком Эссером (Patrick Esser), который участвовал в разработке первой версии Stable Diffusion и с тех пор работал над разными ИИ-алгоритмами, а также другими инженерами, основали компанию Black Forest Lab.

На данный момент стартап представил три модели для генерации по текстовому описанию FLUX.1. ИИ-модель FLUX.1 pro представляет собой наиболее производительный генератор изображений, предназначенный для коммерческого использования через соответствующий API. Вместе с этим были выпущены FLUX.1 dev, доступная для некоммерческого использования, а также более лёгкая и быстрая FLUX.1 schnell (в переводе с немецкого — «быстрый» или «стремительный»).

Разработчики утверждают, что их ИИ-модели превосходят существующие аналоги, такие как Midjourney и DALL-E, по целому ряду показателей, включая качество создаваемых изображений и точность следования исходному описанию. В целом результаты генерации FLUX.1 сопоставимы с тем, что можно создать с помощью DALL-E 3 от OpenAI по точности следования описанию, и близки по фотореалистичности к Midjourney 6. При этом алгоритм явно более качественно работает по сравнению со Stable Diffusion XL, последним крупным релизом команды этих разработчиков, когда они ещё были частью Stability AI, не считая Stable Diffusion XL Turbo.

Модели Black Forest Lab построены на базе гибридной архитектуры, которая объединяет методы трансформации и диффузии, с масштабированием до 12 млрд параметров. Похоже, что такой подход делает нейросеть FLUX.1 способной качественно генерировать руки человека, что было слабым местом многих уже выпущенных на рынок аналогов. При этом разработчики не уточнили, на каких данных обучались модели FLUX.1.

Отметим, что Black Forest Lab уже привлекла финансирование в размере $31 млн. Желающим опробовать FLUX.1 в действии можно воспользоваться сервисами Fal.ai или Replicate.com, где придётся платить деньги для работы с алгоритмами.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Microsoft: массового развёртывания Windows 11 24H2 в октябре не будет 41 мин.
Google вводит кроссплатформенную синхронизацию ключей доступа с помощью PIN-кодов 52 мин.
«Кинопоиск» анонсировал экранизацию Atomic Heart — первые подробности 59 мин.
«Надеемся обратить ваше ожидание в восторг»: режиссёр Lies of P рассказал, чего ждать от дополнения и сиквела 3 ч.
В России тестируют отечественную замену Центру сертификации Microsoft для банков 3 ч.
Кооперативный хоррор No More Room in Hell 2 получил дату выхода в раннем доступе Steam — это продолжение культового зомби-мода для Half-Life 2 4 ч.
Отечественное ПО стало дороже иностранного, но уступает по качеству, заметили во ФСТЭК 5 ч.
«Не думаем, что Hi-Fi Rush 2 нас обогатит»: Krafton спасла Tango Gameworks от закрытия не ради денег 6 ч.
PayPal ввёл для россиян комиссию за неактивные счета — 3500 рублей в год 6 ч.
Биткоин подскочил до $63 тыс. после решения ФРС США о снижении ставки на 0,5 % 6 ч.
Учёные вдохновились кальмарами и создали магнитный дисплей, которому вообще не нужна электроника 2 ч.
У Volkswagen ID.4 на ходу могут внезапно открыться двери — выпуск и продажи электромобилей остановлены, запущен отзыв 2 ч.
Ноутбуки с Intel Lunar Lake действительно долго работают от батареи — Lenovo Yoga продержался почти 24 часа 3 ч.
Планшеты Huawei MatePad Pro 12.2 и MatePad 12 X вышли на глобальный рынок по цене от €569 3 ч.
Sony представила PS5 и PS5 Pro в стиле первой PlayStation по случаю её 30-летия 4 ч.
HPE представила компактный edge-сервер ProLiant DL145 Gen11 на базе AMD EPYC Siena 4 ч.
DJI представила экшн-камеру Osmo Action 5 Pro — 40 Мп, рекордный динамический диапазон и скорость до 960 fps 5 ч.
Intel заявила, что не собирается продавать контрольный пакет Mobileye 6 ч.
Российский электромобиль «Атом» будет узнавать водителя по лицу с помощью ИИ 6 ч.
Новая статья: Обзор умных часов HUAWEI Watch D2: когда умеешь справляться с давлением 6 ч.