Black Forest Labs випустила Flux 3 Image — модель для зображень у родині Flux 3. Вона робить багатоступеневі правки, приймає до 10 референсних зображень і видає до 4K.

За твердженням Black Forest Labs, модель змінює лише вибраний фрагмент, а решту зображення залишає як є. У каталогах і маркетингових серіях, де товар має виглядати однаково, можна сподіватися на меншу кількість перегенерацій.

Що дає багатоступеневе редагування?

Flux 3 Image виконує серію правок у межах одного фрагмента й не змінює решту зображення, за твердженням розробника. Очікуваний ефект — менше зсувів обличчя й освітлення під час заміни тла, але це варто перевірити на власних кадрах.

Модель працює у режимах text-to-image та image-to-image, а також рендерить текст і дає фотографічно реалістичні зображення. Написи на упаковці, імовірно, можна правити тим самим пайплайном, що й саму картинку, тож результат варто перевірити на власних шрифтах і мовах.

Як зібрати сцену боксами й референсами?

Flux 3 Image компонує сцену за допомогою боксів-обмежувачів і приймає до 10 референсних зображень. Розробник задає розташування обʼєктів рамками, а модель, за його задумом, зберігає стиль і зовнішність за зразками.

Безкоштовне демо Flux 3 Image дає змогу прогнати власні кадри до інтеграції API в пайплайн. Максимальний вивід сягає 4K — зіставте його з вимогами до макета ще на етапі тесту.

Скільки коштує доступ і коли вийдуть ваги?

Ціна доступу до Flux 3 Image через API знижена на 50% до 8 жовтня, За даними The Decoder. Компанії також можуть ліцензувати комерційні ваги, щоб запускати модель і дообучати її на власній інфраструктурі.

Відкриті ваги Flux 3 Image мають вийти найближчими тижнями. Незадовго до релізу Ideogram анонсувала власну редагувальну модель Ideogram 4.5, яка теж вийде з відкритими вагами.

Що зробити до 8 жовтня?