Black Forest Labs, ведущая лаборатория в области искусственного интеллекта, представила модель FLUX.2, состоящую из 32 миллиардов параметров. Новая модель предоставляет пользователям беспрецедентные возможности для генерации и редактирования изображений, включая:
- Функцию Multi-Reference, позволяющую создавать десятки вариаций изображений с одинаковым стилем и субъектом.
- Контроль позы персонажа, дающий возможность задавать желаемую позу для субъектов в изображении.
- Генерацию изображений высокого разрешения до 4K с фотореалистичным качеством и точным восприятием естественного освещения и физических свойств объектов.
Одной из ключевых особенностей FLUX.2 является её высокая производительность и энергоэффективность. Благодаря сотрудничеству с NVIDIA и использованию технологии FP8, модель смогла сократить потребление видеопамяти на 40%, достигнув значительного прироста производительности - также на 40%. Это делает FLUX.2 доступным для широких слоев пользователей, включая владельцев домашних компьютеров с видеокартами GeForce RTX.
Вместе с тем, оригинальная версия FLUX.2 предъявляет высокие требования к железу: полная загрузка модели требует 90 ГБ видеопамяти, а минимальная рекомендуемая конфигурация составляет 64 ГБ. Однако квантованная версия, созданная инженерами NVIDIA и Black Forest Labs, успешно решает эту проблему, снижая нагрузку на видеокарту и делая модель доступной даже на персональных компьютерах.
FLUX.2 поддерживает режимы генерации на основе текстовых запросов, изображений и комбинаций изображений. Для улучшения качества и точности модели используется встроенная языковая модель Mistral-3 24B, которая усиливает понимание контекста и физическую достоверность объектов.
На данный момент пользователи могут испытать FLUX.2 двумя основными способами:- Загрузка модели через платформу Hugging Face и запуск в приложении ComfyUI.
- Тестирование на онлайн-ресурсах Falcon AI или Replicate, где предоставляются бесплатные запросы для оценки возможностей модели.
Варианты модели FLUX.2:
- [pro]: Максимальная производительность и качество, сравнимые с лучшими коммерческими моделями, но дешевле и быстрее.
- [flex]: Предоставляет полный контроль над процессом генерации, позволяя тонкой настройке параметров.
- [dev]: Уменьшенная 32B версия, открытая и простая в установке на видеокарты RTX 4090.
- [klein]: Открытая и бесплатная версия, предназначенная для экспериментов и тестирования.
что то не завелась, хоть вроде бы все по инструкции. модели подцепились, а ошибки выкидывает как раз что то с весами
Подтверждаю, Flux 2 какой-то медленный очень, намного медленнее первой версии, но качество не сказать, что во столько же раз возросло, все еще проблемы с анатомией. Но для редактирования кое-где можно использовать, наверное.
Z-Image приятно удивил, быстр, проблемы с анатомией редки, высокая точность, да, лица однообразные, но это поправимо. Жду Edit версию.
Я тут скорее про бесплатные модели, такого уровня генерации вроде еще не было среди бесплатных.
Это да, по сути к флекс 2 примотали синей изолентой лору и улучшатель промптов, но забыли о точности)
А Z-Image намного лучше
Но это Qwen image) у них даже лого намекает) https://github.com/Tongyi-MAI
Потому удобнее заюзать Qwen внутри Krita с помощью https://github.com/Acly/krita-ai-diffusion
https://github.com/Acly/krita-ai-diffusion/release...
Правда непонятно, зачем отделяться от Qwen Image, если
https://www.alibabacloud.com/en/solutions/generati...
всё что они делают внутри Alibaba и Qwen и Tongyi технолоджи единое целое, направленное на решение разных задач под одним общим крылом Qwen)
Но судя по строке Z-Image-Edit To be released лучше дождаться её.