FLUX 3: что действительно вышло, а что осталось за кадром
FLUX 3 вышел 23 июля 2026 года — видео до 20 секунд и нативное аудио, но без модели изображений. Что реально доступно, что говорят бенчмарки и чем пользоваться сегодня.

Black Forest Labs анонсировала FLUX 3 23 июля 2026 года и назвала его мультимодальной фронтир-моделью для визуального интеллекта. Спустя два дня главное для большинства авторов — не то, что умеет FLUX 3, а то, что из этого можно реально запустить. FLUX 3 Video закрыт формой заявки. FLUX 3 Action закрыт партнёрским соглашением. А FLUX 3 Image — та самая часть, на которой построено имя FLUX, — не выпущена вообще.
Этот разрыв и есть главная новость. Компания, которая сделала генерацию изображений с открытыми весами серьёзным вариантом, выпустила флагман, где изобразительная половина отсутствует, а всё остальное в анонсе направлено на видео, аудио и робототехнику. Это настоящий разворот, и он говорит о том, где на этом рынке сейчас давление.
В этом материале мы отделяем анонс от продукта: что существует сегодня, что доказывают и чего не доказывают цифры бенчмарков BFL, в чём на самом деле состоит заявление об архитектуре и чем пользоваться, пока FLUX 3 Image остаётся за листом ожидания.
Что именно анонсировала Black Forest Labs
FLUX 3 представлен как единое семейство моделей, обученное совместно на изображениях, видео, аудио и действиях, а не как четыре отдельные системы. Анонс охватывает FLUX 3 Video, FLUX 3 Image, FLUX 3 Action (с робототехнической версией под названием FLUX-mimic) и будущий FLUX 3 Dev с открытыми весами.
С доступностью картина совсем другая.

Предупреждение
Публичных цен на FLUX 3 нет, количество параметров не опубликовано, технического отчёта по семейству моделей нет, условий лицензии для обещанного релиза с открытыми весами тоже нет. Любая таблица характеристик с разрешением FLUX 3 Image, лимитами референсных изображений или стоимостью за изображение — это домыслы, а не документация.
Модель изображений — недостающая деталь
Формулировка самой BFL: у FLUX 3 Image будет «фаза раннего доступа в ближайшие недели». Это всё публичное обязательство целиком. Ни даты, ни характеристик, ни бенчмарка.
Это важнее обычного поэтапного запуска, потому что генерация изображений — это и есть смысл бренда FLUX. FLUX.1 и линейка редактирования Kontext стали стандартом в пайплайнах с открытыми весами. Анонсировать флагман генерации без этого компонента — в то время как конкуренты выпускают модели изображений еженедельно — значит оставить авторов с утверждениями, которые невозможно проверить.
Практическое следствие: сегодня вы не можете оценить FLUX 3 для работы с изображениями, и никто другой тоже. За разговорами о его рендеринге текста, согласованности персонажей или следовании промпту нет ни одной независимой проверки. Считайте это маркетингом, пока модель нельзя протестировать.
FLUX 3 Video: 20 секунд с нативным звуком
Компонент, который действительно вышел — для одобренных участников раннего доступа, — как раз по-настоящему интересный. FLUX 3 Video создаёт ролики длительностью до 20 секунд с изначально синхронизированным аудио, а не генерирует немое видео с последующим озвучиванием. Он также поддерживает генерацию видео из изображения, из ключевых кадров и сцепку нескольких планов.
Двадцать секунд с нативным звуком — существенная длина. Большинство флагманских видеомоделей до сих пор настроены на ролики по 5–10 секунд, а склейка таких фрагментов во что-то связное съедает значительную часть продакшн-времени. Если FLUX 3 удерживает согласованность персонажа и звука на протяжении 20 секунд, это реальное изменение рабочего процесса.
Это также показывает, где BFL видит растущий рынок. Компания, выросшая на статичных изображениях и строящая генерацию видео из изображения и сцепку планов, пытается захватить весь пайплайн, а не только первый кадр.
Как честно читать таблицу бенчмарков BFL
BFL опубликовала показатели предпочтения FLUX 3 Video против восьми конкурентов. Прежде чем их читать, обратите внимание на четыре оговорки, которые BFL добавляет сама: цифры заявлены самой компанией, предварительные, измерены в середине обучения, на 10-секундных роликах 720p. Независимой проверки нет.

Бросаются в глаза две вещи.
Победы одержаны над моделями, наиболее удалёнными от фронтира. Показатель 93% — против Luma Ray 3.2, а 77% — против Runway Gen-4.5. Это самые широкие отрывы на диаграмме, и они же — два сравнения, где планка ниже всего.
Против текущего фронтира — ничья. FLUX 3 предпочли в 52% сравнений против Seedance 2.0 и в 52% против Gemini Omni Flash. В тесте на предпочтение 52% — это подбрасывание монетки. BFL заслуживает уважения за то, что опубликовала это честно, а не тихо убрала строки, — но подбрасывание монетки против моделей, в которых вы уже сегодня можете генерировать, не повод ждать листа ожидания.
Пять из восьми моделей на этой диаграмме прямо сейчас есть в видеоселекторе OmniArt: Grok Imagine, Kling, Happy Horse, Seedance 2.0 и Gemini Omni Flash. Вы можете прогнать тот же бриф, на котором BFL делала бенчмарк, уже сегодня и сами оценить базовый уровень.
Примечание
Ролики ниже — результаты Seedance, сгенерированные в OmniArt, то есть той самой модели, против которой FLUX 3 набрал 52%. Они здесь для того, чтобы показать текущий базовый уровень, который действительно можно получить сегодня, а не чтобы представлять результаты FLUX 3. Публичных примеров FLUX 3, которые мы могли бы независимо проверить, не существует.
Self-Flow: заявление об архитектуре, за которым стоит следить
Техническая идея, стоящая за FLUX 3, называется Self-Flow — самообучаемое сопоставление потоков с потокенным обусловливанием по временному шагу, опубликованное как исследование одновременно с запуском. Заявляется более быстрая сходимость по сравнению с прежними подходами выравнивания представлений и единая базовая архитектура, в которой обучение на изображениях, видео, аудио и действиях взаимно ограничивает друг друга.
Если это подтвердится, интересное следствие — вовсе не более сильная модель изображений. Оно в том, что улучшения в одной модальности должны подтягивать остальные, потому что они делят общее представление, а не сидят в отдельных башнях. Это та же ставка, которую сделала Google с линейкой Gemini omni, только заход с противоположной стороны: Google пришла из языка, а BFL идёт от пикселей.
За такой ставкой стоит следить. Но это ещё не результат, которым можно пользоваться.
Проверка реальностью: FLUX.2
Поскольку FLUX 3 Image публично не существует, самой свежей пригодной моделью изображений FLUX остаётся FLUX.2, вышедшая в ноябре 2025 года и расширенная уровнем max в декабре и компактной линейкой klein в январе 2026 года.
| Вариант | Доступность | Прайс-лист | Примечания |
|---|---|---|---|
| FLUX.2 [max] | API | $0,07 / МП | Верхний уровень; добавляет генерацию с опорой на живой веб-поиск |
| FLUX.2 [pro] | API | $0,03 / МП | Экономичный вариант по умолчанию для генерации и редактирования |
| FLUX.2 [flex] | API | $0,06 / МП | Открывает шаги и guidance; настроен под типографику |
| FLUX.2 [dev] 32B | Открытые веса | Своя инфраструктура | Некоммерческая лицензия; коммерческое использование — платный тариф |
| FLUX.2 [klein] 4B | Открытые веса | Своя инфраструктура | Apache 2.0 — единственный вариант со свободной лицензией |
В чём FLUX.2 по-прежнему выигрывает
- Согласованность по нескольким референсам. Восемь референсных изображений через API, десять в плейграунде. Зафиксируйте лицо, продукт, схему света — и получите связную серию. Это остаётся его самым явным структурным преимуществом.
- Точный фирменный цвет. Значения HEX, привязанные к названному объекту, — документированная возможность первого класса. Привязывайте значение к предмету — «машина цвета #FF0000», — а не оставляйте его болтаться в промпте.
- Фотореализм материалов. Подповерхностное рассеивание в коже, зеркальное поведение стекла и металла, то, как ткань поглощает свет и как отражает.
- Генерация с опорой на веб в [max]. Живой веб-поиск во время генерации — для актуальных товаров и недавних событий. В своём классе больше никто так не умеет.
Где он отстал
Со слепыми тестами предпочтения картина менее лестная. В арене text-to-image от Artificial Analysis FLUX.2 [max] сейчас держится примерно на 16-м месте, позади GPT Image 2, семейства Nano Banana 2 и Seedream 5.0 Pro. FLUX.2 [dev] — открытый флагман на 32B — находится ниже Qwen Image 2.0 Pro, модели на 7B под лицензией Apache 2.0.
Другие сложности, о которых стоит знать до того, как строить на нём пайплайн:
- Нет негативных промптов. Переписывайте всё в утвердительной форме. «Резкость по всему кадру» вместо «без размытия».
- Ограничения лицензии. Веса [dev] на 32B некоммерческие. Только вариант klein на 4B под Apache 2.0.
- Стоимость железа. [dev] в полной точности плюс его текстовый энкодер Mistral на 24B далеко выходит за пределы потребительской видеопамяти; сообщество запускает квантованные сборки с потерей качества.
- Претензии к анатомии. Кисти рук и взаимодействие нескольких персонажей — постоянные слабые места в обсуждениях сообщества, особенно у дистиллированных вариантов klein на низком числе шагов по умолчанию.
Приёмы промптинга, которые переносятся куда угодно
Опубликованное BFL руководство по промптам для FLUX.2 — это хороший ремесленный совет, который переносится на большинство современных моделей изображений, включая доступные в OmniArt.
Стройте структуру как Subject + Action + Style + Context. Порядок слов имеет вес; начинайте с самого важного. От тридцати до восьмидесяти слов — задокументированная золотая середина.
Заключайте буквальный текст в кавычки. The text 'OPEN' appears in red neon letters — а затем укажите расположение, насыщенность и цвет.
Описывайте шрифты, а не называйте их. «Жирный геометрический гротеск со слегка расширенным кернингом» срабатывает куда надёжнее, чем название конкретной гарнитуры.
Назначьте роль каждому референсному изображению. Укажите, какой вход задаёт объект, какой — стиль, а какой — фон.
Используйте JSON, когда нужно версионировать бриф. Заморозьте структуру, меняйте ровно один ключ на вариант — и вы получите контролируемое сравнение вместо случайного переброса:
{
"scene": "Studio product photography on polished concrete",
"subjects": [{ "description": "Matte black ceramic mug, steam rising", "position": "center foreground" }],
"style": "Ultra-realistic commercial product photography",
"color_palette": ["matte black", "concrete gray", "soft white highlights"],
"lighting": "Three-point softbox, soft diffused highlights, no harsh shadows",
"camera": { "angle": "high", "lens-mm": 85, "f-number": "f/5.6" }
}
Совет
Самая ценная привычка из руководства BFL — переписывание в утвердительной форме. Вместо «фары не направлены на героя» пишите «фары светят вдоль дороги, освещая мокрый асфальт впереди и оставляя фигуру в мягком силуэте». Это работает на любой модели, а не только на FLUX.
Что делать на этой неделе
Если вы ждали FLUX 3, чтобы начать проект, честный совет — не ждать. У модели изображений нет даты, а видеомодель закрыта заявкой без опубликованных цен.
| Если вы ждали FLUX 3 ради… | Сделайте это сегодня |
|---|---|
| Фотореалистичных кадров и съёмки товаров | GPT Image 2 или Seedream 5.0 Pro в селекторе изображений OmniArt |
| Согласованности персонажа по нескольким референсам | Seedream 5.0 Pro, принимающий до 10 референсных изображений |
| Макетов и постеров с большим количеством текста | GPT Image 2 — текущий лидер по тексту внутри изображения |
| Длинных роликов с синхронным звуком | Seedance 2.0 или Gemini Omni Flash — оба доступны прямо сейчас |
| Готового кадра, который хочется оживить | Любая модель «изображение в видео» в OmniArt |
Последнюю строку большинство недооценивает. Пайплайн, который BFL пытается захватить, — сгенерировать кадр, а затем его оживить — уже работает от начала до конца в одном рабочем пространстве. Наше руководство по моделям «изображение в видео» объясняет, какую модель выбрать под какой тип движения, а руководство по промптам Seedance — как режиссировать кадр, а не просто описывать его.
Описано
Отрежиссировано
За чем следить дальше
Три сигнала подскажут, стоит ли возвращаться к FLUX 3.
- Открытие раннего доступа к FLUX 3 Image вместе с характеристиками. Количество референсных изображений, нативное разрешение и цена — вот цифры, которые определят, конкурентоспособна ли модель.
- Независимые бенчмарки FLUX 3 Video. Тесты предпочтения от самого вендора, измеренные в середине обучения, — отправная точка, а не результат. Настоящая проверка — место в арене против Seedance и линейки Gemini omni.
- Лицензия на открытые веса. FLUX.2 [dev] был некоммерческим, и одно это решение стоило BFL значительной части её позиций в открытом коде. Повторит ли это FLUX 3 Dev — от этого зависит, вернётся ли локальная экосистема.
Как начать в OmniArt
Чтобы сделать что-то на этой неделе, вам не нужно выбирать сторону в истории с запуском FLUX 3. OmniArt держит генерацию изображений, видео, аудио и музыки в одном рабочем пространстве, а актуальные флагманские модели — GPT Image 2, Nano Banana, Seedream, Seedance, Kling, Veo, Grok Imagine и Gemini Omni Flash — собраны за одним селектором и одним балансом кредитов.
Это и есть практичный ответ на закрытый запуск: вы оцениваете модели по собственному брифу, а не по диаграмме вендора, и переключаетесь, когда выходит что-то действительно лучше. Когда FLUX 3 Image станет доступен для тестов, мы прогоним его по тем же брифам и опубликуем сравнение. А пока посмотрите, как все видеомодели собраны в одном рабочем пространстве, чтобы понять, что доступно сегодня.
Готовы создавать?
Начните генерировать впечатляющий контент с ИИ