Black Forest Labs выпустила FLUX 3 Image. Модель умеет и генерировать, и редактировать изображения — отдельный режим переключать не нужно. После первой генерации можно выделить область и изменить конкретный объект, сохранив большую часть кадра.
Bounding boxes помогают заранее разметить композицию. Можно указать, где будут персонаж, продукт, лицо или текст. Эти зоны потом получится редактировать отдельно: двигать, удалять или заменять.
Что умеет FLUX 3 Image
BFL отдельно говорит о pixel-perfect editing. Логика понятная: меняем нужный участок, а остальная картинка остаётся на месте. Для раскадровок, рекламных кадров и серий с одним персонажем это способно убрать часть привычной возни.
Но пиксельная точность не означает, что каждый соседний пиксель застынет навсегда. В документации есть оговорка: тени, отражения и освещение рядом с объектом иногда меняются. Локальная правка работает, а полной стерильности пока ждать не стоит.
Ещё несколько параметров FLUX 3 Image: • нативный вывод до 4K, примерно 16 МП; • до 10 референсов одновременно; • bounding boxes для раскладки сцены; • один endpoint для генерации и редактирования; • grounding включён по умолчанию — модель может использовать web/image search для актуального контекста.
С 4K здесь важна именно нативность. Картинку не делают маленькой, а потом не прогоняют через апскейлер. У FLUX.2 потолок был около 4 МП, а для новой версии заявлен заметно больший рабочий размер.
FLUX 3 Image: цена и доступ
Заявленные цены за одно изображение такие: • 768 × 768 — $0.041; • 1K — $0.048; • 2K — $0.100; • 4K — $0.607. На сайте BFL сейчас также мелькает промо для 1K за $0.024 вместо $0.048. Срок и условия скидки нормально не расписаны, поэтому постоянной ценой я бы её не считал.
Для компаний уже доступны Commercial Weights. Их можно развернуть самостоятельно, дообучить и запустить на своей инфраструктуре. Стоимость обсуждается отдельно.
Кому пригодится FLUX 3 Image
В первую очередь визуальному продакшену. Я бы проверил модель на трёх задачах: собрать раскадровку с заданными зонами, заменить объект в готовом кадре и удержать одного персонажа через набор референсов.
Для видео это особенно полезно на ключевых кадрах. Из-за одной надписи, лица или предмета не придётся каждый раз генерировать сцену заново. Можно поправить конкретную область и сохранить основную композицию.
