updateModelos e insights13 min de leitura

FLUX 3 explicado: o que realmente foi lançado e o que ficou de fora

O FLUX 3 chegou em 23 de julho de 2026 com vídeo de 20 segundos e áudio nativo — mas sem modelo de imagem. O que saiu, o que os benchmarks dizem e o que usar hoje.

Equipe OmniArt
FLUX 3 explicado: o que realmente foi lançado e o que ficou de fora

A Black Forest Labs anunciou o FLUX 3 em 23 de julho de 2026 e o chamou de modelo multimodal de fronteira para inteligência visual. Dois dias depois, a manchete que importa para a maioria dos criadores não é o que o FLUX 3 faz — é o que você consegue de fato rodar. O FLUX 3 Video está atrás de um formulário de inscrição. O FLUX 3 Action está atrás de um acordo de parceria. E o FLUX 3 Image, a parte sobre a qual o nome FLUX foi construído, simplesmente não foi lançada.

Essa lacuna é a história. A empresa que transformou a geração de imagens com pesos abertos em uma opção séria lançou um carro-chefe em que a metade de imagem é a peça faltante, e apontou o resto do anúncio para vídeo, áudio e robótica. É uma virada real, e diz algo sobre onde está a pressão neste mercado.

Este texto separa o anúncio do produto: o que existe hoje, o que os números de benchmark da BFL provam e não provam, qual é de fato a afirmação sobre a arquitetura, e o que usar enquanto o FLUX 3 Image segue atrás da lista de espera.

O que a Black Forest Labs realmente anunciou

O FLUX 3 é apresentado como uma única família de modelos treinada de forma conjunta em imagem, vídeo, áudio e ação, em vez de quatro sistemas separados. O anúncio cobre FLUX 3 Video, FLUX 3 Image, FLUX 3 Action (com uma variante de robótica chamada FLUX-mimic) e um futuro FLUX 3 Dev de pesos abertos.

A disponibilidade é uma tabela completamente diferente.

Status de lançamento de cada componente do FLUX 3 dois dias após o anúncio, mostrando vídeo e ação em acesso antecipado enquanto o modelo de imagem, os pesos abertos e os preços seguem sem lançamento
Status de lançamento de cada componente do FLUX 3 dois dias após o anúncio, mostrando vídeo e ação em acesso antecipado enquanto o modelo de imagem, os pesos abertos e os preços seguem sem lançamento

Aviso

Não há preço público do FLUX 3, nenhuma contagem de parâmetros divulgada, nenhum relatório técnico da família de modelos e nenhum termo de licença para o prometido lançamento de pesos abertos. Qualquer ficha técnica que você encontrar citando resolução do FLUX 3 Image, limites de imagens de referência ou custo por imagem é extrapolação, não documentação.

O modelo de imagem é a peça que falta

A própria BFL diz que o FLUX 3 Image terá "uma fase de acesso antecipado nas próximas semanas". Esse é todo o compromisso público. Sem data, sem especificações, sem benchmark.

Isso pesa mais do que um lançamento escalonado comum, porque geração de imagens é o que a marca FLUX significa. O FLUX.1 e sua linha de edição Kontext viraram padrão em pipelines de pesos abertos. Anunciar um carro-chefe de geração sem esse componente disponível — enquanto concorrentes lançam modelos de imagem toda semana — deixa os criadores com afirmações que não conseguem testar.

A consequência prática: você não consegue avaliar o FLUX 3 para trabalho de imagem hoje, e ninguém mais consegue. As alegações que circulam sobre renderização de texto, consistência de personagem ou aderência ao prompt não têm nenhuma avaliação independente por trás. Trate tudo como marketing até o modelo ser testável.

FLUX 3 Video: 20 segundos com áudio nativo

O componente que de fato saiu — para candidatos aprovados no acesso antecipado — é o genuinamente interessante. O FLUX 3 Video gera clipes de até 20 segundos com áudio sincronizado de forma nativa, em vez de gerar vídeo mudo e sonorizá-lo depois. Ele também cobre imagem para vídeo, keyframe para vídeo e encadeamento de múltiplos planos.

Vinte segundos com som nativo é um comprimento significativo. A maioria dos modelos de vídeo de ponta ainda é ajustada em torno de clipes de 5 a 10 segundos, e costurar isso em algo coerente é onde boa parte do tempo de produção vai embora. Se o FLUX 3 sustentar continuidade de personagem e de áudio ao longo de 20 segundos, isso é uma mudança real de fluxo de trabalho.

Também mostra onde a BFL acredita estar o mercado em crescimento. Uma casa de imagem estática construindo imagem para vídeo e encadeamento de planos é uma empresa tentando dominar o pipeline inteiro, não só o primeiro quadro.

Lendo a tabela de benchmarks da BFL com honestidade

A BFL publicou taxas de preferência do FLUX 3 Video contra oito concorrentes. Antes de lê-las, note as quatro ressalvas que a própria BFL anexa: os números são autodeclarados, preliminares, medidos durante o meio do treinamento, em clipes de 10 segundos em 720p. Não há verificação independente.

Gráfico de barras das taxas de preferência do FLUX 3 Video contra oito modelos concorrentes, com os cinco modelos disponíveis na OmniArt destacados
Gráfico de barras das taxas de preferência do FLUX 3 Video contra oito modelos concorrentes, com os cinco modelos disponíveis na OmniArt destacados

Duas coisas chamam atenção.

As vitórias são contra os modelos mais distantes da fronteira. O número de 93% é contra o Luma Ray 3.2 e o de 77% contra o Runway Gen-4.5. São as margens mais largas do gráfico, e também as duas comparações em que a régua é mais baixa.

Contra a fronteira atual, é empate. O FLUX 3 foi preferido em 52% das comparações contra o Seedance 2.0 e 52% contra o Gemini Omni Flash. Em um teste de preferência, 52% é cara ou coroa. Crédito à BFL por publicar isso com honestidade em vez de omitir as linhas discretamente — mas um cara ou coroa contra modelos com os quais você já pode gerar hoje não é motivo para esperar por uma lista de espera.

Cinco dos oito modelos daquele gráfico estão no seletor de vídeo da OmniArt agora: Grok Imagine, Kling, Happy Horse, Seedance 2.0 e Gemini Omni Flash. Você pode rodar o mesmo briefing que a BFL usou no benchmark ainda esta tarde e julgar a linha de base por conta própria.

Nota

Os clipes abaixo são saídas do Seedance geradas na OmniArt — o modelo contra o qual o FLUX 3 marcou 52%. Eles estão aqui para mostrar a linha de base que você realmente consegue produzir hoje, não para representar saídas do FLUX 3. Não existem amostras públicas do FLUX 3 que possamos verificar de forma independente.

Seedance na OmniArt: a escala fazendo o trabalho emocional — uma figura pequena diante de um sinal imenso. Este é o patamar contra o qual o FLUX 3 Video reporta uma taxa de preferência de 52%.
Uma relação sem diálogo sustentada por luz de fogueira, vapor e uma criança adormecida — atmosfera e gesto no lugar de exposição.

Self-Flow: a afirmação de arquitetura que vale acompanhar

A ideia técnica por trás do FLUX 3 se chama Self-Flow — flow matching auto-supervisionado com condicionamento de timestep por token, publicado como pesquisa junto com o lançamento. A alegação é de convergência mais rápida do que abordagens anteriores de alinhamento de representação, e de uma única arquitetura subjacente na qual o treinamento de imagem, vídeo, áudio e ação restringe um ao outro.

Se isso se sustentar, a consequência interessante não é um modelo de imagem melhor. É que melhorias em uma modalidade devem elevar as outras, porque elas compartilham a representação em vez de ficarem em torres separadas. É a mesma aposta que o Google fez com a linha Gemini omni, chegando pelo lado oposto — o Google veio da linguagem, a BFL está vindo dos pixels.

É uma aposta que vale acompanhar. Ainda não é um resultado que você possa usar.

O teste de realidade do FLUX.2

Como o FLUX 3 Image não existe publicamente, o modelo de imagem FLUX utilizável mais recente ainda é o FLUX.2, lançado em novembro de 2025 e estendido por um nível max em dezembro e uma linha compacta klein em janeiro de 2026.

VarianteDisponibilidadePreço de tabelaObservações
FLUX.2 [max]APIUS$ 0,07 / MPNível mais alto; adiciona geração fundamentada com busca web ao vivo
FLUX.2 [pro]APIUS$ 0,03 / MPO padrão com bom custo-benefício para geração e edição
FLUX.2 [flex]APIUS$ 0,06 / MPExpõe steps e guidance; ajustado para tipografia
FLUX.2 [dev] 32BPesos abertosAuto-hospedagemLicença não comercial; uso comercial exige plano pago
FLUX.2 [klein] 4BPesos abertosAuto-hospedagemApache 2.0 — a única variante com licença permissiva

Onde o FLUX.2 ainda ganha

  • Consistência com múltiplas referências. Oito imagens de referência pela API, dez no playground. Trave um rosto, um produto, um esquema de luz e gere uma série coerente. Essa segue sendo sua vantagem estrutural mais clara.
  • Cor exata de marca. Valores hexadecimais vinculados a um objeto nomeado são um recurso documentado e de primeira classe. Vincule o valor à coisa — "o carro é #FF0000" — em vez de deixá-lo solto no prompt.
  • Fotorrealismo de materiais. Espalhamento subsuperficial na pele, comportamento especular em vidro e metal, como o tecido absorve versus reflete.
  • Geração fundamentada no [max]. Busca web ao vivo durante a geração, para produtos atuais e eventos recentes. Nada mais no seu nível faz isso.

Onde ele ficou para trás

O quadro de preferência cega é menos lisonjeiro. Na arena de texto para imagem da Artificial Analysis, o FLUX.2 [max] está hoje por volta do 16º lugar, atrás do GPT Image 2, da família Nano Banana 2 e do Seedream 5.0 Pro. O FLUX.2 [dev] — o carro-chefe aberto de 32B — fica abaixo do Qwen Image 2.0 Pro, um modelo de 7B com licença Apache 2.0.

Outros atritos que vale conhecer antes de comprometer um pipeline com ele:

  • Sem prompts negativos. Reescreva tudo de forma positiva. "Foco nítido em toda a cena" em vez de "sem desfoque".
  • Limites de licença. Os pesos [dev] de 32B são não comerciais. Só a variante klein de 4B é Apache 2.0.
  • Custo de hardware. O [dev] em precisão total mais seu codificador de texto Mistral de 24B fica muito além da VRAM de consumo; a comunidade roda builds quantizados com perda de qualidade.
  • Reclamações de anatomia. Mãos e interação entre várias pessoas são modos de falha recorrentes nas discussões da comunidade, principalmente nas variantes klein destiladas com suas contagens de steps baixas padrão.

Padrões de prompt que se transferem

O guia de prompts publicado pela BFL para o FLUX.2 é um bom conselho de ofício que se transfere para a maioria dos modelos de imagem modernos, incluindo os disponíveis na OmniArt.

Estruture como Subject + Action + Style + Context. A ordem das palavras tem peso; comece pelo que mais importa. De trinta a oitenta palavras é o ponto ideal documentado.

Coloque texto literal entre aspas. The text 'OPEN' appears in red neon letters — depois especifique posição, peso e cor.

Descreva fontes, não as nomeie. "Sans-serif geométrica em negrito com kerning levemente expandido" acerta muito mais do que citar o nome de uma tipografia.

Atribua um papel a cada imagem de referência. Diga qual entrada fornece o sujeito, qual fornece o estilo e qual fornece o fundo.

Use JSON quando precisar versionar um briefing. Congele a estrutura, mude exatamente uma chave por variação, e você obtém uma comparação controlada em vez de uma nova rodada aleatória:

{
  "scene": "Studio product photography on polished concrete",
  "subjects": [{ "description": "Matte black ceramic mug, steam rising", "position": "center foreground" }],
  "style": "Ultra-realistic commercial product photography",
  "color_palette": ["matte black", "concrete gray", "soft white highlights"],
  "lighting": "Three-point softbox, soft diffused highlights, no harsh shadows",
  "camera": { "angle": "high", "lens-mm": 85, "f-number": "f/5.6" }
}

Dica

O hábito de maior valor no guia da BFL é a reescrita positiva. Em vez de "faróis não apontados para o sujeito", escreva "faróis apontados estrada abaixo, iluminando o asfalto molhado à frente, deixando a figura em silhueta suave". Funciona em todos os modelos, não só no FLUX.

O que fazer esta semana

Se você estava esperando o FLUX 3 para começar um projeto, o conselho honesto é não esperar. O modelo de imagem não tem data, e o modelo de vídeo está travado atrás de uma inscrição sem preço divulgado.

Se você queria o FLUX 3 para…Faça isto hoje
Fotos realistas e trabalho de produtoGPT Image 2 ou Seedream 5.0 Pro no seletor de imagens da OmniArt
Consistência de personagem com múltiplas referênciasSeedream 5.0 Pro, que aceita até 10 imagens de referência
Layouts e pôsteres com muito textoGPT Image 2 — o líder atual em texto dentro da imagem
Clipes longos com som sincronizadoSeedance 2.0 ou Gemini Omni Flash, ambos disponíveis agora
Uma imagem que você já gosta, transformada em movimentoQualquer modelo de imagem para vídeo na OmniArt

A última linha é a que mais gente subestima. O pipeline que a BFL está tentando dominar — gerar uma imagem e depois animá-la — já funciona de ponta a ponta em um único workspace. Nosso guia de modelos de imagem para vídeo cobre qual modelo escolher para cada tipo de movimento, e o guia de prompts do Seedance mostra como dirigir um plano em vez de apenas descrevê-lo.

Descrito

Dirigido

Mesmo conceito, dois prompts. Dirigir o plano — clima, intenção de câmera e sobre o que a cena é — vence listar o conteúdo dela. Essa habilidade se transfere para qualquer modelo que vencer.

O que observar a seguir

Três sinais vão dizer se o FLUX 3 vale uma segunda visita.

  1. A abertura do acesso antecipado ao FLUX 3 Image, com especificações. Quantidade de imagens de referência, resolução nativa e preço são os números que determinam se ele compete.
  2. Benchmarks independentes do FLUX 3 Video. Testes de preferência do próprio fornecedor medidos no meio do treinamento são um ponto de partida, não um resultado. Posição em arena contra o Seedance e a linha Gemini omni é o teste de verdade.
  3. A licença dos pesos abertos. O FLUX.2 [dev] era não comercial, e essa única decisão custou à BFL boa parte da sua posição em código aberto. Se o FLUX 3 Dev repetir isso, vai decidir se o ecossistema local volta.

Como começar na OmniArt

Você não precisa escolher um lado no lançamento do FLUX 3 para criar algo esta semana. A OmniArt mantém geração de imagem, vídeo, áudio e música em um único workspace, com os modelos de ponta atuais — GPT Image 2, Nano Banana, Seedream, Seedance, Kling, Veo, Grok Imagine e Gemini Omni Flash — atrás de um único seletor e de um único saldo de créditos.

Essa é a resposta prática a um lançamento restrito: você avalia modelos contra o seu próprio briefing em vez do gráfico de um fornecedor, e troca quando algo genuinamente melhor aparecer. Quando o FLUX 3 Image ficar testável, vamos rodá-lo contra os mesmos briefings e publicar a comparação. Até lá, veja todos os modelos de vídeo em um único workspace para saber o que está disponível hoje.

Pronto para criar?

Comece a gerar conteúdo incrível com IA

Começar grátis