updateМодели и аналитика11 мин чтения

FLUX 3: что действительно вышло, а что осталось за кадром

FLUX 3 вышел 23 июля 2026 года — видео до 20 секунд и нативное аудио, но без модели изображений. Что реально доступно, что говорят бенчмарки и чем пользоваться сегодня.

Команда OmniArt
FLUX 3: что действительно вышло, а что осталось за кадром

Black Forest Labs анонсировала FLUX 3 23 июля 2026 года и назвала его мультимодальной фронтир-моделью для визуального интеллекта. Спустя два дня главное для большинства авторов — не то, что умеет FLUX 3, а то, что из этого можно реально запустить. FLUX 3 Video закрыт формой заявки. FLUX 3 Action закрыт партнёрским соглашением. А FLUX 3 Image — та самая часть, на которой построено имя FLUX, — не выпущена вообще.

Этот разрыв и есть главная новость. Компания, которая сделала генерацию изображений с открытыми весами серьёзным вариантом, выпустила флагман, где изобразительная половина отсутствует, а всё остальное в анонсе направлено на видео, аудио и робототехнику. Это настоящий разворот, и он говорит о том, где на этом рынке сейчас давление.

В этом материале мы отделяем анонс от продукта: что существует сегодня, что доказывают и чего не доказывают цифры бенчмарков BFL, в чём на самом деле состоит заявление об архитектуре и чем пользоваться, пока FLUX 3 Image остаётся за листом ожидания.

Что именно анонсировала Black Forest Labs

FLUX 3 представлен как единое семейство моделей, обученное совместно на изображениях, видео, аудио и действиях, а не как четыре отдельные системы. Анонс охватывает FLUX 3 Video, FLUX 3 Image, FLUX 3 Action (с робототехнической версией под названием FLUX-mimic) и будущий FLUX 3 Dev с открытыми весами.

С доступностью картина совсем другая.

Статус выпуска каждого компонента FLUX 3 через два дня после анонса: видео и действия в раннем доступе, а модель изображений, открытые веса и цены остаются невыпущенными
Статус выпуска каждого компонента FLUX 3 через два дня после анонса: видео и действия в раннем доступе, а модель изображений, открытые веса и цены остаются невыпущенными

Предупреждение

Публичных цен на FLUX 3 нет, количество параметров не опубликовано, технического отчёта по семейству моделей нет, условий лицензии для обещанного релиза с открытыми весами тоже нет. Любая таблица характеристик с разрешением FLUX 3 Image, лимитами референсных изображений или стоимостью за изображение — это домыслы, а не документация.

Модель изображений — недостающая деталь

Формулировка самой BFL: у FLUX 3 Image будет «фаза раннего доступа в ближайшие недели». Это всё публичное обязательство целиком. Ни даты, ни характеристик, ни бенчмарка.

Это важнее обычного поэтапного запуска, потому что генерация изображений — это и есть смысл бренда FLUX. FLUX.1 и линейка редактирования Kontext стали стандартом в пайплайнах с открытыми весами. Анонсировать флагман генерации без этого компонента — в то время как конкуренты выпускают модели изображений еженедельно — значит оставить авторов с утверждениями, которые невозможно проверить.

Практическое следствие: сегодня вы не можете оценить FLUX 3 для работы с изображениями, и никто другой тоже. За разговорами о его рендеринге текста, согласованности персонажей или следовании промпту нет ни одной независимой проверки. Считайте это маркетингом, пока модель нельзя протестировать.

FLUX 3 Video: 20 секунд с нативным звуком

Компонент, который действительно вышел — для одобренных участников раннего доступа, — как раз по-настоящему интересный. FLUX 3 Video создаёт ролики длительностью до 20 секунд с изначально синхронизированным аудио, а не генерирует немое видео с последующим озвучиванием. Он также поддерживает генерацию видео из изображения, из ключевых кадров и сцепку нескольких планов.

Двадцать секунд с нативным звуком — существенная длина. Большинство флагманских видеомоделей до сих пор настроены на ролики по 5–10 секунд, а склейка таких фрагментов во что-то связное съедает значительную часть продакшн-времени. Если FLUX 3 удерживает согласованность персонажа и звука на протяжении 20 секунд, это реальное изменение рабочего процесса.

Это также показывает, где BFL видит растущий рынок. Компания, выросшая на статичных изображениях и строящая генерацию видео из изображения и сцепку планов, пытается захватить весь пайплайн, а не только первый кадр.

Как честно читать таблицу бенчмарков BFL

BFL опубликовала показатели предпочтения FLUX 3 Video против восьми конкурентов. Прежде чем их читать, обратите внимание на четыре оговорки, которые BFL добавляет сама: цифры заявлены самой компанией, предварительные, измерены в середине обучения, на 10-секундных роликах 720p. Независимой проверки нет.

Столбчатая диаграмма показателей предпочтения FLUX 3 Video против восьми конкурирующих моделей, с выделением пяти моделей, доступных в OmniArt
Столбчатая диаграмма показателей предпочтения FLUX 3 Video против восьми конкурирующих моделей, с выделением пяти моделей, доступных в OmniArt

Бросаются в глаза две вещи.

Победы одержаны над моделями, наиболее удалёнными от фронтира. Показатель 93% — против Luma Ray 3.2, а 77% — против Runway Gen-4.5. Это самые широкие отрывы на диаграмме, и они же — два сравнения, где планка ниже всего.

Против текущего фронтира — ничья. FLUX 3 предпочли в 52% сравнений против Seedance 2.0 и в 52% против Gemini Omni Flash. В тесте на предпочтение 52% — это подбрасывание монетки. BFL заслуживает уважения за то, что опубликовала это честно, а не тихо убрала строки, — но подбрасывание монетки против моделей, в которых вы уже сегодня можете генерировать, не повод ждать листа ожидания.

Пять из восьми моделей на этой диаграмме прямо сейчас есть в видеоселекторе OmniArt: Grok Imagine, Kling, Happy Horse, Seedance 2.0 и Gemini Omni Flash. Вы можете прогнать тот же бриф, на котором BFL делала бенчмарк, уже сегодня и сами оценить базовый уровень.

Примечание

Ролики ниже — результаты Seedance, сгенерированные в OmniArt, то есть той самой модели, против которой FLUX 3 набрал 52%. Они здесь для того, чтобы показать текущий базовый уровень, который действительно можно получить сегодня, а не чтобы представлять результаты FLUX 3. Публичных примеров FLUX 3, которые мы могли бы независимо проверить, не существует.

Seedance в OmniArt: масштаб делает всю эмоциональную работу — одна маленькая фигура на фоне огромного сигнала. Именно против этого уровня FLUX 3 Video заявляет показатель предпочтения 52%.
Отношения без единой реплики, держащиеся на свете костра, паре и спящем ребёнке — атмосфера и жест вместо объяснений.

Self-Flow: заявление об архитектуре, за которым стоит следить

Техническая идея, стоящая за FLUX 3, называется Self-Flow — самообучаемое сопоставление потоков с потокенным обусловливанием по временному шагу, опубликованное как исследование одновременно с запуском. Заявляется более быстрая сходимость по сравнению с прежними подходами выравнивания представлений и единая базовая архитектура, в которой обучение на изображениях, видео, аудио и действиях взаимно ограничивает друг друга.

Если это подтвердится, интересное следствие — вовсе не более сильная модель изображений. Оно в том, что улучшения в одной модальности должны подтягивать остальные, потому что они делят общее представление, а не сидят в отдельных башнях. Это та же ставка, которую сделала Google с линейкой Gemini omni, только заход с противоположной стороны: Google пришла из языка, а BFL идёт от пикселей.

За такой ставкой стоит следить. Но это ещё не результат, которым можно пользоваться.

Проверка реальностью: FLUX.2

Поскольку FLUX 3 Image публично не существует, самой свежей пригодной моделью изображений FLUX остаётся FLUX.2, вышедшая в ноябре 2025 года и расширенная уровнем max в декабре и компактной линейкой klein в январе 2026 года.

ВариантДоступностьПрайс-листПримечания
FLUX.2 [max]API$0,07 / МПВерхний уровень; добавляет генерацию с опорой на живой веб-поиск
FLUX.2 [pro]API$0,03 / МПЭкономичный вариант по умолчанию для генерации и редактирования
FLUX.2 [flex]API$0,06 / МПОткрывает шаги и guidance; настроен под типографику
FLUX.2 [dev] 32BОткрытые весаСвоя инфраструктураНекоммерческая лицензия; коммерческое использование — платный тариф
FLUX.2 [klein] 4BОткрытые весаСвоя инфраструктураApache 2.0 — единственный вариант со свободной лицензией

В чём FLUX.2 по-прежнему выигрывает

  • Согласованность по нескольким референсам. Восемь референсных изображений через API, десять в плейграунде. Зафиксируйте лицо, продукт, схему света — и получите связную серию. Это остаётся его самым явным структурным преимуществом.
  • Точный фирменный цвет. Значения HEX, привязанные к названному объекту, — документированная возможность первого класса. Привязывайте значение к предмету — «машина цвета #FF0000», — а не оставляйте его болтаться в промпте.
  • Фотореализм материалов. Подповерхностное рассеивание в коже, зеркальное поведение стекла и металла, то, как ткань поглощает свет и как отражает.
  • Генерация с опорой на веб в [max]. Живой веб-поиск во время генерации — для актуальных товаров и недавних событий. В своём классе больше никто так не умеет.

Где он отстал

Со слепыми тестами предпочтения картина менее лестная. В арене text-to-image от Artificial Analysis FLUX.2 [max] сейчас держится примерно на 16-м месте, позади GPT Image 2, семейства Nano Banana 2 и Seedream 5.0 Pro. FLUX.2 [dev] — открытый флагман на 32B — находится ниже Qwen Image 2.0 Pro, модели на 7B под лицензией Apache 2.0.

Другие сложности, о которых стоит знать до того, как строить на нём пайплайн:

  • Нет негативных промптов. Переписывайте всё в утвердительной форме. «Резкость по всему кадру» вместо «без размытия».
  • Ограничения лицензии. Веса [dev] на 32B некоммерческие. Только вариант klein на 4B под Apache 2.0.
  • Стоимость железа. [dev] в полной точности плюс его текстовый энкодер Mistral на 24B далеко выходит за пределы потребительской видеопамяти; сообщество запускает квантованные сборки с потерей качества.
  • Претензии к анатомии. Кисти рук и взаимодействие нескольких персонажей — постоянные слабые места в обсуждениях сообщества, особенно у дистиллированных вариантов klein на низком числе шагов по умолчанию.

Приёмы промптинга, которые переносятся куда угодно

Опубликованное BFL руководство по промптам для FLUX.2 — это хороший ремесленный совет, который переносится на большинство современных моделей изображений, включая доступные в OmniArt.

Стройте структуру как Subject + Action + Style + Context. Порядок слов имеет вес; начинайте с самого важного. От тридцати до восьмидесяти слов — задокументированная золотая середина.

Заключайте буквальный текст в кавычки. The text 'OPEN' appears in red neon letters — а затем укажите расположение, насыщенность и цвет.

Описывайте шрифты, а не называйте их. «Жирный геометрический гротеск со слегка расширенным кернингом» срабатывает куда надёжнее, чем название конкретной гарнитуры.

Назначьте роль каждому референсному изображению. Укажите, какой вход задаёт объект, какой — стиль, а какой — фон.

Используйте JSON, когда нужно версионировать бриф. Заморозьте структуру, меняйте ровно один ключ на вариант — и вы получите контролируемое сравнение вместо случайного переброса:

{
  "scene": "Studio product photography on polished concrete",
  "subjects": [{ "description": "Matte black ceramic mug, steam rising", "position": "center foreground" }],
  "style": "Ultra-realistic commercial product photography",
  "color_palette": ["matte black", "concrete gray", "soft white highlights"],
  "lighting": "Three-point softbox, soft diffused highlights, no harsh shadows",
  "camera": { "angle": "high", "lens-mm": 85, "f-number": "f/5.6" }
}

Совет

Самая ценная привычка из руководства BFL — переписывание в утвердительной форме. Вместо «фары не направлены на героя» пишите «фары светят вдоль дороги, освещая мокрый асфальт впереди и оставляя фигуру в мягком силуэте». Это работает на любой модели, а не только на FLUX.

Что делать на этой неделе

Если вы ждали FLUX 3, чтобы начать проект, честный совет — не ждать. У модели изображений нет даты, а видеомодель закрыта заявкой без опубликованных цен.

Если вы ждали FLUX 3 ради…Сделайте это сегодня
Фотореалистичных кадров и съёмки товаровGPT Image 2 или Seedream 5.0 Pro в селекторе изображений OmniArt
Согласованности персонажа по нескольким референсамSeedream 5.0 Pro, принимающий до 10 референсных изображений
Макетов и постеров с большим количеством текстаGPT Image 2 — текущий лидер по тексту внутри изображения
Длинных роликов с синхронным звукомSeedance 2.0 или Gemini Omni Flash — оба доступны прямо сейчас
Готового кадра, который хочется оживитьЛюбая модель «изображение в видео» в OmniArt

Последнюю строку большинство недооценивает. Пайплайн, который BFL пытается захватить, — сгенерировать кадр, а затем его оживить — уже работает от начала до конца в одном рабочем пространстве. Наше руководство по моделям «изображение в видео» объясняет, какую модель выбрать под какой тип движения, а руководство по промптам Seedance — как режиссировать кадр, а не просто описывать его.

Описано

Отрежиссировано

Одна идея, два промпта. Режиссура кадра — настроение, замысел камеры и то, о чём сцена — выигрывает у перечисления её содержимого. Этот навык переносится на любую модель, которая победит.

За чем следить дальше

Три сигнала подскажут, стоит ли возвращаться к FLUX 3.

  1. Открытие раннего доступа к FLUX 3 Image вместе с характеристиками. Количество референсных изображений, нативное разрешение и цена — вот цифры, которые определят, конкурентоспособна ли модель.
  2. Независимые бенчмарки FLUX 3 Video. Тесты предпочтения от самого вендора, измеренные в середине обучения, — отправная точка, а не результат. Настоящая проверка — место в арене против Seedance и линейки Gemini omni.
  3. Лицензия на открытые веса. FLUX.2 [dev] был некоммерческим, и одно это решение стоило BFL значительной части её позиций в открытом коде. Повторит ли это FLUX 3 Dev — от этого зависит, вернётся ли локальная экосистема.

Как начать в OmniArt

Чтобы сделать что-то на этой неделе, вам не нужно выбирать сторону в истории с запуском FLUX 3. OmniArt держит генерацию изображений, видео, аудио и музыки в одном рабочем пространстве, а актуальные флагманские модели — GPT Image 2, Nano Banana, Seedream, Seedance, Kling, Veo, Grok Imagine и Gemini Omni Flash — собраны за одним селектором и одним балансом кредитов.

Это и есть практичный ответ на закрытый запуск: вы оцениваете модели по собственному брифу, а не по диаграмме вендора, и переключаетесь, когда выходит что-то действительно лучше. Когда FLUX 3 Image станет доступен для тестов, мы прогоним его по тем же брифам и опубликуем сравнение. А пока посмотрите, как все видеомодели собраны в одном рабочем пространстве, чтобы понять, что доступно сегодня.

Готовы создавать?

Начните генерировать впечатляющий контент с ИИ

Начать бесплатно