UpdateМоделі та аналітика11 хв читання

FLUX 3 без прикрас: що справді вийшло, а що ні

FLUX 3 вийшов 23 липня 2026 року з відео на 20 секунд і власним аудіо — але без моделі для зображень. Що вийшло, що насправді кажуть бенчмарки та чим користуватися сьогодні.

Команда OmniArt
FLUX 3 без прикрас: що справді вийшло, а що ні

Black Forest Labs анонсувала FLUX 3 23 липня 2026 року й назвала його мультимодальною передовою моделлю візуального інтелекту. За два дні головна новина для більшості авторів — не те, що FLUX 3 уміє, а те, що з нього можна реально запустити. FLUX 3 Video стоїть за формою заявки. FLUX 3 Action — за партнерською угодою. А FLUX 3 Image, та сама частина, на якій збудовано ім’я FLUX, не вийшла взагалі.

Саме цей розрив і є історією. Компанія, яка зробила генерацію зображень із відкритими вагами серйозним варіантом, випустила флагман, у якому бракує саме половини із зображеннями, і спрямувала решту анонсу на відео, аудіо й робототехніку. Це справжній розворот, і він дещо каже про те, де в цьому ринку тиск.

Цей матеріал відділяє анонс від продукту: що існує сьогодні, що доводять і чого не доводять числа бенчмарків BFL, у чому насправді полягає заява про архітектуру й чим користуватися, поки FLUX 3 Image лишається за списком очікування.

Що саме анонсувала Black Forest Labs

FLUX 3 подають як одну родину моделей, натреновану спільно на зображеннях, відео, аудіо та діях, а не як чотири окремі системи. Анонс охоплює FLUX 3 Video, FLUX 3 Image, FLUX 3 Action (із варіантом для робототехніки під назвою FLUX-mimic) і майбутній FLUX 3 Dev із відкритими вагами.

Доступність — це вже зовсім інша таблиця.

Статус релізу кожного компонента FLUX 3 через два дні після анонсу: відео й дії в ранньому доступі, а модель для зображень, відкриті ваги та ціни ще не випущено
Статус релізу кожного компонента FLUX 3 через два дні після анонсу: відео й дії в ранньому доступі, а модель для зображень, відкриті ваги та ціни ще не випущено

Попередження

Публічних цін на FLUX 3 немає, кількість параметрів не оприлюднено, технічного звіту для родини моделей немає, як немає й ліцензійних умов для обіцяного релізу з відкритими вагами. Будь-яка таблиця характеристик, у якій наведено роздільну здатність FLUX 3 Image, ліміти референсних зображень чи вартість одного зображення, — це екстраполяція, а не документація.

Модель для зображень — та сама відсутня деталь

Власне формулювання BFL таке: FLUX 3 Image отримає «фазу раннього доступу протягом найближчих тижнів». Це вся публічна обіцянка. Ні дати, ні характеристик, ні бенчмарка.

Це важить більше за звичайне поетапне розгортання, бо генерація зображень — це і є те, що означає бренд FLUX. FLUX.1 та його лінійка редагування Kontext стали типовим вибором у конвеєрах із відкритими вагами. Анонсувати флагманське покоління без цього компонента — поки конкуренти випускають моделі для зображень щотижня — означає залишити авторів із заявами, які вони не можуть перевірити.

Практичний наслідок: сьогодні ви не можете оцінити FLUX 3 для роботи із зображеннями, і ніхто інший теж не може. За заявами, що ходять довкола, — про рендеринг тексту, сталість персонажів чи дотримання промпту — немає жодної незалежної перевірки. Вважайте їх маркетингом, поки модель не можна протестувати.

FLUX 3 Video: 20 секунд із власним аудіо

Компонент, який таки вийшов — для схвалених учасників раннього доступу, — і є по-справжньому цікавим. FLUX 3 Video генерує кліпи завдовжки до 20 секунд із синхронізованим власним аудіо, а не генерує німе відео, щоб потім підкласти звук. Він також охоплює «зображення у відео», «ключовий кадр у відео» та зчеплення кількох кадрів.

Двадцять секунд із власним звуком — істотна тривалість. Більшість флагманських відеомоделей досі налаштовані на кліпи від 5 до 10 секунд, і саме на зшивання їх у щось цілісне йде чимало виробничого часу. Якщо FLUX 3 тримає персонажа й безперервність аудіо на проміжку у 20 секунд, це справжня зміна робочого процесу.

Це також показує, де BFL бачить ринок зростання. Коли компанія, що виросла на нерухомому зображенні, будує «зображення у відео» й зчеплення кадрів, вона намагається володіти всім конвеєром, а не лише першим кадром.

Як чесно читати таблицю бенчмарків BFL

BFL опублікувала показники переваги FLUX 3 Video проти восьми конкурентів. Перш ніж їх читати, зверніть увагу на чотири застереження, які додає сама BFL: числа самозвітні, попередні, зняті посеред тренування, на десятисекундних кліпах 720p. Незалежної перевірки немає.

Стовпчикова діаграма показників переваги FLUX 3 Video проти восьми конкурентних моделей, де підсвічено п’ять моделей, доступних в OmniArt
Стовпчикова діаграма показників переваги FLUX 3 Video проти восьми конкурентних моделей, де підсвічено п’ять моделей, доступних в OmniArt

Впадають в око дві речі.

Перемоги здобуто над моделями, найдальшими від передового краю. Показник 93 % — це проти Luma Ray 3.2, а 77 % — проти Runway Gen-4.5. Це найширші розриви на діаграмі, і водночас це два порівняння, де планка найнижча.

Проти нинішнього передового краю — нічия. FLUX 3 обрали в 52 % порівнянь проти Seedance 2.0 і в 52 % проти Gemini Omni Flash. У тесті на перевагу 52 % — це підкидання монетки. BFL заслуговує на повагу за те, що опублікувала це чесно, а не тихо прибрала рядки, — але підкидання монетки проти моделей, якими ви вже можете генерувати сьогодні, не привід чекати на список очікування.

П’ять із восьми моделей на тій діаграмі просто зараз є у вибірнику відеомоделей OmniArt: Grok Imagine, Kling, Happy Horse, Seedance 2.0 і Gemini Omni Flash. Ви можете вже сьогодні по обіді прогнати той самий бриф, на якому BFL робила заміри, і оцінити базову планку самотужки.

Примітка

Кліпи нижче — це результат Seedance, згенерований в OmniArt, тобто саме тієї моделі, проти якої FLUX 3 набрав 52 %. Вони тут, щоб показати нинішню базову планку, яку ви справді можете отримати сьогодні, а не щоб представляти результат FLUX 3. Публічних зразків FLUX 3, які ми могли б незалежно перевірити, не існує.

Seedance в OmniArt: масштаб виконує емоційну роботу — одна маленька постать проти велетенського сигналу. Це той рівень, проти якого FLUX 3 Video повідомляє про 52 % переваги.
Стосунки без жодної репліки, які тримаються на світлі вогню, парі та сплячій дитині, — атмосфера й жест замість пояснень.

Self-Flow: заява про архітектуру, за якою варто стежити

Технічна ідея за FLUX 3 називається Self-Flow — самонаглядове flow matching із покроковим обумовленням за токенами, опубліковане як дослідження разом із запуском. Заява полягає у швидшій збіжності, ніж у попередніх підходів із вирівнюванням репрезентацій, і в єдиній базовій архітектурі, де тренування на зображеннях, відео, аудіо та діях взаємно обмежують одне одного.

Якщо це справдиться, цікавий наслідок — не краща модель для зображень. Він у тому, що покращення в одній модальності мають підтягувати решту, бо вони ділять одну репрезентацію, а не сидять в окремих вежах. Це та сама ставка, яку зробив Google з лінійкою Gemini omni, тільки з протилежного боку: Google прийшов від мови, а BFL іде від пікселів.

За цією ставкою варто стежити. Але це поки що не результат, яким можна користуватися.

Перевірка реальністю: FLUX.2

Оскільки FLUX 3 Image публічно не існує, найновіша придатна до роботи модель FLUX для зображень — це досі FLUX.2, що вийшла в листопаді 2025 року й розширилася рівнем max у грудні та компактною лінійкою klein у січні 2026 року.

ВаріантДоступністьЦіна за прайсомПримітки
FLUX.2 [max]API$0.07 / MPВерхній рівень; додає генерацію з опорою на живий пошук у вебі
FLUX.2 [pro]API$0.03 / MPОщадливий типовий вибір для генерації та редагування
FLUX.2 [flex]API$0.06 / MPВідкриває кроки й guidance; заточена під типографіку
FLUX.2 [dev] 32BВідкриті вагиСамостійний хостингНекомерційна ліцензія; комерційне використання — платний рівень
FLUX.2 [klein] 4BВідкриті вагиСамостійний хостингApache 2.0 — єдиний варіант із дозвільною ліцензією

У чому FLUX.2 досі виграє

  • Сталість за багатьма референсами. Вісім референсних зображень через API, десять у пісочниці. Зафіксуйте обличчя, товар, схему світла — і згенеруйте цілісну серію. Це й далі її найвиразніша структурна перевага.
  • Точний колір бренду. Hex-значення, прив’язане до названого об’єкта, — задокументована повноцінна функція. Прив’язуйте значення до речі — "the car is #FF0000" — а не лишайте його плавати в промпті.
  • Фотореалізм матеріалів. Підповерхневе розсіювання у шкірі, поведінка відблисків на склі та металі, те, як тканина поглинає світло на противагу відбиванню.
  • Генерація з опорою на веб у [max]. Живий пошук у вебі під час генерації — для актуальних товарів і свіжих подій. Ніхто інший у її рівні цього не робить.

У чому вона відстала

Картина сліпих переваг менш утішна. В арені «текст у зображення» від Artificial Analysis FLUX.2 [max] нині десь на 16-му місці, позаду GPT Image 2, родини Nano Banana 2 та Seedream 5.0 Pro. FLUX.2 [dev] — відкритий флагман на 32B — стоїть нижче за Qwen Image 2.0 Pro, модель на 7B під Apache 2.0.

Інші тертя, про які варто знати, перш ніж класти на неї конвеєр:

  • Немає негативних промптів. Переписуйте все ствердно. "Sharp focus throughout" замість "no blur."
  • Обмеження ліцензії. Ваги [dev] на 32B некомерційні. Лише варіант klein на 4B має Apache 2.0.
  • Вартість заліза. [dev] у повній точності разом із текстовим енкодером Mistral на 24B далеко за межами споживчої відеопам’яті; спільнота ганяє квантовані збірки з втратою якості.
  • Скарги на анатомію. Руки та взаємодія кількох людей — повторювані режими збою в гілках спільноти, особливо на дистильованих варіантах klein із типово малою кількістю кроків.

Шаблони промптів, які переносяться далі

Опубліковані BFL поради щодо промптів для FLUX.2 — це добре ремесло, яке переноситься на більшість сучасних моделей для зображень, зокрема й на ті, що є в OmniArt.

Структура Subject + Action + Style + Context. Порядок слів має вагу; починайте з того, що важить найбільше. Задокументована золота середина — від тридцяти до вісімдесяти слів.

Цитуйте літеральний текст. The text 'OPEN' appears in red neon letters — а тоді вкажіть розташування, насиченість і колір.

Описуйте шрифти, а не називайте їх. "Bold geometric sans-serif with slightly extended kerning" спрацьовує значно надійніше, ніж назва гарнітури.

Призначайте роль кожному референсному зображенню. Скажіть, який вхідний матеріал дає суб’єкта, який — стиль, а який — тло.

Беріть JSON, коли брифу потрібні версії. Заморозьте структуру, змінюйте рівно один ключ на варіант — і отримаєте контрольоване порівняння замість чергового перекидання кубика:

{
  "scene": "Studio product photography on polished concrete",
  "subjects": [{ "description": "Matte black ceramic mug, steam rising", "position": "center foreground" }],
  "style": "Ultra-realistic commercial product photography",
  "color_palette": ["matte black", "concrete gray", "soft white highlights"],
  "lighting": "Three-point softbox, soft diffused highlights, no harsh shadows",
  "camera": { "angle": "high", "lens-mm": 85, "f-number": "f/5.6" }
}

Порада

Найцінніша звичка з посібника BFL — переписування ствердно. Замість "headlights not on the subject" пишіть "headlights pointing down the road, illuminating the wet asphalt ahead, leaving the figure in soft silhouette." Це працює на будь-якій моделі, не тільки на FLUX.

Що робити цього тижня

Якщо ви чекали на FLUX 3, щоб почати проєкт, чесна порада — не чекати. У моделі для зображень немає дати, а відеомодель закрита заявкою без опублікованих цін.

Якщо ви хотіли FLUX 3 для…Зробіть це сьогодні
Фотореалістичних кадрів і зйомки товаруGPT Image 2 або Seedream 5.0 Pro у вибірнику зображень OmniArt
Сталості персонажа за багатьма референсамиSeedream 5.0 Pro, яка бере до 10 референсних зображень
Насичених текстом верстки й постерівGPT Image 2 — нинішній лідер за текстом усередині зображення
Довгих кліпів із синхронним звукомSeedance 2.0 або Gemini Omni Flash, обидві вже доступні
Кадру, який вам уже подобається, перетвореного на рухБудь-яка модель «зображення у відео» в OmniArt

Останній рядок недооцінюють найчастіше. Конвеєр, яким BFL намагається заволодіти, — згенерувати кадр, а тоді оживити його — вже працює від початку до кінця в одному просторі. Наш посібник із моделей «зображення у відео» розповідає, яку модель брати під який тип руху, а посібник із промптів для Seedance — як режисувати кадр, а не просто його описувати.

Описано

Зрежисовано

Той самий задум, два промпти. Зрежисувати кадр — настрій, наміри камери й те, про що сцена — сильніше, ніж перелічити її вміст. Ця навичка переноситься на будь-яку модель, яка переможе.

За чим стежити далі

Три сигнали покажуть, чи варто повертатися до FLUX 3.

  1. Відкриття раннього доступу до FLUX 3 Image разом із характеристиками. Кількість референсних зображень, нативна роздільна здатність і ціни — саме ті числа, що вирішать, чи є він конкурентом.
  2. Незалежні бенчмарки для FLUX 3 Video. Тести переваги від провайдера, зняті посеред тренування, — це відправна точка, а не результат. Справжня перевірка — місце в арені проти Seedance і лінійки Gemini omni.
  3. Ліцензія на відкриті ваги. FLUX.2 [dev] була некомерційною, і саме це одне рішення коштувало BFL значної частини її позиції у відкритому коді. Чи повторить це FLUX 3 Dev — від цього залежить, чи повернеться локальна екосистема.

Із чого почати в OmniArt

Щоб зробити щось цього тижня, не обов’язково ставати на чийсь бік у розгортанні FLUX 3. OmniArt тримає генерацію зображень, відео, аудіо та музики в одному просторі, а нинішні флагманські моделі — GPT Image 2, Nano Banana, Seedream, Seedance, Kling, Veo, Grok Imagine та Gemini Omni Flash — сидять за одним вибірником і одним балансом кредитів.

Це й є практична відповідь на закритий запуск: ви оцінюєте моделі за власним брифом, а не за діаграмою провайдера, і переходите тоді, коли виходить щось справді краще. Коли FLUX 3 Image стане придатним для тестування, ми проженемо його на тих самих брифах і опублікуємо порівняння. А поки що дивіться всі відеомоделі в одному просторі — про те, що доступне вже сьогодні.

Готові творити?

Почніть створювати вражаючий контент зі ШІ

Почати безкоштовно