FLUX 3 без прикрас: що справді вийшло, а що ні
FLUX 3 вийшов 23 липня 2026 року з відео на 20 секунд і власним аудіо — але без моделі для зображень. Що вийшло, що насправді кажуть бенчмарки та чим користуватися сьогодні.

Black Forest Labs анонсувала FLUX 3 23 липня 2026 року й назвала його мультимодальною передовою моделлю візуального інтелекту. За два дні головна новина для більшості авторів — не те, що FLUX 3 уміє, а те, що з нього можна реально запустити. FLUX 3 Video стоїть за формою заявки. FLUX 3 Action — за партнерською угодою. А FLUX 3 Image, та сама частина, на якій збудовано ім’я FLUX, не вийшла взагалі.
Саме цей розрив і є історією. Компанія, яка зробила генерацію зображень із відкритими вагами серйозним варіантом, випустила флагман, у якому бракує саме половини із зображеннями, і спрямувала решту анонсу на відео, аудіо й робототехніку. Це справжній розворот, і він дещо каже про те, де в цьому ринку тиск.
Цей матеріал відділяє анонс від продукту: що існує сьогодні, що доводять і чого не доводять числа бенчмарків BFL, у чому насправді полягає заява про архітектуру й чим користуватися, поки FLUX 3 Image лишається за списком очікування.
Що саме анонсувала Black Forest Labs
FLUX 3 подають як одну родину моделей, натреновану спільно на зображеннях, відео, аудіо та діях, а не як чотири окремі системи. Анонс охоплює FLUX 3 Video, FLUX 3 Image, FLUX 3 Action (із варіантом для робототехніки під назвою FLUX-mimic) і майбутній FLUX 3 Dev із відкритими вагами.
Доступність — це вже зовсім інша таблиця.

Попередження
Публічних цін на FLUX 3 немає, кількість параметрів не оприлюднено, технічного звіту для родини моделей немає, як немає й ліцензійних умов для обіцяного релізу з відкритими вагами. Будь-яка таблиця характеристик, у якій наведено роздільну здатність FLUX 3 Image, ліміти референсних зображень чи вартість одного зображення, — це екстраполяція, а не документація.
Модель для зображень — та сама відсутня деталь
Власне формулювання BFL таке: FLUX 3 Image отримає «фазу раннього доступу протягом найближчих тижнів». Це вся публічна обіцянка. Ні дати, ні характеристик, ні бенчмарка.
Це важить більше за звичайне поетапне розгортання, бо генерація зображень — це і є те, що означає бренд FLUX. FLUX.1 та його лінійка редагування Kontext стали типовим вибором у конвеєрах із відкритими вагами. Анонсувати флагманське покоління без цього компонента — поки конкуренти випускають моделі для зображень щотижня — означає залишити авторів із заявами, які вони не можуть перевірити.
Практичний наслідок: сьогодні ви не можете оцінити FLUX 3 для роботи із зображеннями, і ніхто інший теж не може. За заявами, що ходять довкола, — про рендеринг тексту, сталість персонажів чи дотримання промпту — немає жодної незалежної перевірки. Вважайте їх маркетингом, поки модель не можна протестувати.
FLUX 3 Video: 20 секунд із власним аудіо
Компонент, який таки вийшов — для схвалених учасників раннього доступу, — і є по-справжньому цікавим. FLUX 3 Video генерує кліпи завдовжки до 20 секунд із синхронізованим власним аудіо, а не генерує німе відео, щоб потім підкласти звук. Він також охоплює «зображення у відео», «ключовий кадр у відео» та зчеплення кількох кадрів.
Двадцять секунд із власним звуком — істотна тривалість. Більшість флагманських відеомоделей досі налаштовані на кліпи від 5 до 10 секунд, і саме на зшивання їх у щось цілісне йде чимало виробничого часу. Якщо FLUX 3 тримає персонажа й безперервність аудіо на проміжку у 20 секунд, це справжня зміна робочого процесу.
Це також показує, де BFL бачить ринок зростання. Коли компанія, що виросла на нерухомому зображенні, будує «зображення у відео» й зчеплення кадрів, вона намагається володіти всім конвеєром, а не лише першим кадром.
Як чесно читати таблицю бенчмарків BFL
BFL опублікувала показники переваги FLUX 3 Video проти восьми конкурентів. Перш ніж їх читати, зверніть увагу на чотири застереження, які додає сама BFL: числа самозвітні, попередні, зняті посеред тренування, на десятисекундних кліпах 720p. Незалежної перевірки немає.

Впадають в око дві речі.
Перемоги здобуто над моделями, найдальшими від передового краю. Показник 93 % — це проти Luma Ray 3.2, а 77 % — проти Runway Gen-4.5. Це найширші розриви на діаграмі, і водночас це два порівняння, де планка найнижча.
Проти нинішнього передового краю — нічия. FLUX 3 обрали в 52 % порівнянь проти Seedance 2.0 і в 52 % проти Gemini Omni Flash. У тесті на перевагу 52 % — це підкидання монетки. BFL заслуговує на повагу за те, що опублікувала це чесно, а не тихо прибрала рядки, — але підкидання монетки проти моделей, якими ви вже можете генерувати сьогодні, не привід чекати на список очікування.
П’ять із восьми моделей на тій діаграмі просто зараз є у вибірнику відеомоделей OmniArt: Grok Imagine, Kling, Happy Horse, Seedance 2.0 і Gemini Omni Flash. Ви можете вже сьогодні по обіді прогнати той самий бриф, на якому BFL робила заміри, і оцінити базову планку самотужки.
Примітка
Кліпи нижче — це результат Seedance, згенерований в OmniArt, тобто саме тієї моделі, проти якої FLUX 3 набрав 52 %. Вони тут, щоб показати нинішню базову планку, яку ви справді можете отримати сьогодні, а не щоб представляти результат FLUX 3. Публічних зразків FLUX 3, які ми могли б незалежно перевірити, не існує.
Self-Flow: заява про архітектуру, за якою варто стежити
Технічна ідея за FLUX 3 називається Self-Flow — самонаглядове flow matching із покроковим обумовленням за токенами, опубліковане як дослідження разом із запуском. Заява полягає у швидшій збіжності, ніж у попередніх підходів із вирівнюванням репрезентацій, і в єдиній базовій архітектурі, де тренування на зображеннях, відео, аудіо та діях взаємно обмежують одне одного.
Якщо це справдиться, цікавий наслідок — не краща модель для зображень. Він у тому, що покращення в одній модальності мають підтягувати решту, бо вони ділять одну репрезентацію, а не сидять в окремих вежах. Це та сама ставка, яку зробив Google з лінійкою Gemini omni, тільки з протилежного боку: Google прийшов від мови, а BFL іде від пікселів.
За цією ставкою варто стежити. Але це поки що не результат, яким можна користуватися.
Перевірка реальністю: FLUX.2
Оскільки FLUX 3 Image публічно не існує, найновіша придатна до роботи модель FLUX для зображень — це досі FLUX.2, що вийшла в листопаді 2025 року й розширилася рівнем max у грудні та компактною лінійкою klein у січні 2026 року.
| Варіант | Доступність | Ціна за прайсом | Примітки |
|---|---|---|---|
| FLUX.2 [max] | API | $0.07 / MP | Верхній рівень; додає генерацію з опорою на живий пошук у вебі |
| FLUX.2 [pro] | API | $0.03 / MP | Ощадливий типовий вибір для генерації та редагування |
| FLUX.2 [flex] | API | $0.06 / MP | Відкриває кроки й guidance; заточена під типографіку |
| FLUX.2 [dev] 32B | Відкриті ваги | Самостійний хостинг | Некомерційна ліцензія; комерційне використання — платний рівень |
| FLUX.2 [klein] 4B | Відкриті ваги | Самостійний хостинг | Apache 2.0 — єдиний варіант із дозвільною ліцензією |
У чому FLUX.2 досі виграє
- Сталість за багатьма референсами. Вісім референсних зображень через API, десять у пісочниці. Зафіксуйте обличчя, товар, схему світла — і згенеруйте цілісну серію. Це й далі її найвиразніша структурна перевага.
- Точний колір бренду. Hex-значення, прив’язане до названого об’єкта, — задокументована повноцінна функція. Прив’язуйте значення до речі — "the car is #FF0000" — а не лишайте його плавати в промпті.
- Фотореалізм матеріалів. Підповерхневе розсіювання у шкірі, поведінка відблисків на склі та металі, те, як тканина поглинає світло на противагу відбиванню.
- Генерація з опорою на веб у [max]. Живий пошук у вебі під час генерації — для актуальних товарів і свіжих подій. Ніхто інший у її рівні цього не робить.
У чому вона відстала
Картина сліпих переваг менш утішна. В арені «текст у зображення» від Artificial Analysis FLUX.2 [max] нині десь на 16-му місці, позаду GPT Image 2, родини Nano Banana 2 та Seedream 5.0 Pro. FLUX.2 [dev] — відкритий флагман на 32B — стоїть нижче за Qwen Image 2.0 Pro, модель на 7B під Apache 2.0.
Інші тертя, про які варто знати, перш ніж класти на неї конвеєр:
- Немає негативних промптів. Переписуйте все ствердно. "Sharp focus throughout" замість "no blur."
- Обмеження ліцензії. Ваги [dev] на 32B некомерційні. Лише варіант klein на 4B має Apache 2.0.
- Вартість заліза. [dev] у повній точності разом із текстовим енкодером Mistral на 24B далеко за межами споживчої відеопам’яті; спільнота ганяє квантовані збірки з втратою якості.
- Скарги на анатомію. Руки та взаємодія кількох людей — повторювані режими збою в гілках спільноти, особливо на дистильованих варіантах klein із типово малою кількістю кроків.
Шаблони промптів, які переносяться далі
Опубліковані BFL поради щодо промптів для FLUX.2 — це добре ремесло, яке переноситься на більшість сучасних моделей для зображень, зокрема й на ті, що є в OmniArt.
Структура Subject + Action + Style + Context. Порядок слів має вагу; починайте з того, що важить найбільше. Задокументована золота середина — від тридцяти до вісімдесяти слів.
Цитуйте літеральний текст. The text 'OPEN' appears in red neon letters — а тоді вкажіть розташування, насиченість і колір.
Описуйте шрифти, а не називайте їх. "Bold geometric sans-serif with slightly extended kerning" спрацьовує значно надійніше, ніж назва гарнітури.
Призначайте роль кожному референсному зображенню. Скажіть, який вхідний матеріал дає суб’єкта, який — стиль, а який — тло.
Беріть JSON, коли брифу потрібні версії. Заморозьте структуру, змінюйте рівно один ключ на варіант — і отримаєте контрольоване порівняння замість чергового перекидання кубика:
{
"scene": "Studio product photography on polished concrete",
"subjects": [{ "description": "Matte black ceramic mug, steam rising", "position": "center foreground" }],
"style": "Ultra-realistic commercial product photography",
"color_palette": ["matte black", "concrete gray", "soft white highlights"],
"lighting": "Three-point softbox, soft diffused highlights, no harsh shadows",
"camera": { "angle": "high", "lens-mm": 85, "f-number": "f/5.6" }
}
Порада
Найцінніша звичка з посібника BFL — переписування ствердно. Замість "headlights not on the subject" пишіть "headlights pointing down the road, illuminating the wet asphalt ahead, leaving the figure in soft silhouette." Це працює на будь-якій моделі, не тільки на FLUX.
Що робити цього тижня
Якщо ви чекали на FLUX 3, щоб почати проєкт, чесна порада — не чекати. У моделі для зображень немає дати, а відеомодель закрита заявкою без опублікованих цін.
| Якщо ви хотіли FLUX 3 для… | Зробіть це сьогодні |
|---|---|
| Фотореалістичних кадрів і зйомки товару | GPT Image 2 або Seedream 5.0 Pro у вибірнику зображень OmniArt |
| Сталості персонажа за багатьма референсами | Seedream 5.0 Pro, яка бере до 10 референсних зображень |
| Насичених текстом верстки й постерів | GPT Image 2 — нинішній лідер за текстом усередині зображення |
| Довгих кліпів із синхронним звуком | Seedance 2.0 або Gemini Omni Flash, обидві вже доступні |
| Кадру, який вам уже подобається, перетвореного на рух | Будь-яка модель «зображення у відео» в OmniArt |
Останній рядок недооцінюють найчастіше. Конвеєр, яким BFL намагається заволодіти, — згенерувати кадр, а тоді оживити його — вже працює від початку до кінця в одному просторі. Наш посібник із моделей «зображення у відео» розповідає, яку модель брати під який тип руху, а посібник із промптів для Seedance — як режисувати кадр, а не просто його описувати.
Описано
Зрежисовано
За чим стежити далі
Три сигнали покажуть, чи варто повертатися до FLUX 3.
- Відкриття раннього доступу до FLUX 3 Image разом із характеристиками. Кількість референсних зображень, нативна роздільна здатність і ціни — саме ті числа, що вирішать, чи є він конкурентом.
- Незалежні бенчмарки для FLUX 3 Video. Тести переваги від провайдера, зняті посеред тренування, — це відправна точка, а не результат. Справжня перевірка — місце в арені проти Seedance і лінійки Gemini omni.
- Ліцензія на відкриті ваги. FLUX.2 [dev] була некомерційною, і саме це одне рішення коштувало BFL значної частини її позиції у відкритому коді. Чи повторить це FLUX 3 Dev — від цього залежить, чи повернеться локальна екосистема.
Із чого почати в OmniArt
Щоб зробити щось цього тижня, не обов’язково ставати на чийсь бік у розгортанні FLUX 3. OmniArt тримає генерацію зображень, відео, аудіо та музики в одному просторі, а нинішні флагманські моделі — GPT Image 2, Nano Banana, Seedream, Seedance, Kling, Veo, Grok Imagine та Gemini Omni Flash — сидять за одним вибірником і одним балансом кредитів.
Це й є практична відповідь на закритий запуск: ви оцінюєте моделі за власним брифом, а не за діаграмою провайдера, і переходите тоді, коли виходить щось справді краще. Коли FLUX 3 Image стане придатним для тестування, ми проженемо його на тих самих брифах і опублікуємо порівняння. А поки що дивіться всі відеомоделі в одному просторі — про те, що доступне вже сьогодні.
Готові творити?
Почніть створювати вражаючий контент зі ШІ