FLUX 3 décrypté : ce qui a réellement été livré, et ce qui manque
FLUX 3 est sorti le 23 juillet 2026 : 20 secondes de vidéo et audio natif, mais aucun modèle d'image. Ce qui a été livré, ce que valent les benchmarks, quoi utiliser.

Black Forest Labs a annoncé FLUX 3 le 23 juillet 2026 en le présentant comme un modèle multimodal de frontière pour l'intelligence visuelle. Deux jours plus tard, ce qui compte vraiment pour la plupart des créateurs, ce n'est pas ce que fait FLUX 3 — c'est ce que vous pouvez réellement exécuter. FLUX 3 Video est derrière un formulaire de candidature. FLUX 3 Action est derrière un accord de partenariat. Et FLUX 3 Image, la partie sur laquelle le nom FLUX s'est construit, n'a tout simplement pas été publiée.
C'est cet écart qui fait l'histoire. L'entreprise qui a fait de la génération d'images en poids ouverts une option sérieuse livre un modèle phare dont la moitié image est justement la pièce manquante, et oriente le reste de l'annonce vers la vidéo, l'audio et la robotique. C'est un vrai virage, et il en dit long sur l'endroit où se situe la pression dans ce marché.
Cet article sépare l'annonce du produit : ce qui existe aujourd'hui, ce que les chiffres de benchmark de BFL prouvent ou non, ce qu'affirme réellement l'architecture, et vers quoi se tourner tant que FLUX 3 Image reste derrière la liste d'attente.
Ce que Black Forest Labs a réellement annoncé
FLUX 3 est présenté comme une seule famille de modèles entraînée conjointement sur l'image, la vidéo, l'audio et l'action, plutôt que comme quatre systèmes distincts. L'annonce couvre FLUX 3 Video, FLUX 3 Image, FLUX 3 Action (avec une variante robotique appelée FLUX-mimic) et un futur FLUX 3 Dev en poids ouverts.
La disponibilité, elle, raconte une tout autre histoire.

Avertissement
Il n'existe aucun tarif public pour FLUX 3, aucun nombre de paramètres publié, aucun rapport technique pour la famille de modèles, et aucune condition de licence pour la publication promise en poids ouverts. Toute fiche technique citant la résolution de FLUX 3 Image, ses limites d'images de référence ou son coût par image relève de l'extrapolation, pas de la documentation.
Le modèle d'image est la pièce manquante
BFL indique de ses propres mots que FLUX 3 Image bénéficiera d'« une phase d'accès anticipé dans les semaines à venir ». C'est là tout l'engagement public. Pas de date, pas de spécifications, pas de benchmark.
Cela compte davantage qu'un déploiement échelonné ordinaire, parce que la génération d'images est ce que la marque FLUX signifie. FLUX.1 et sa ligne d'édition Kontext sont devenus une valeur par défaut dans les pipelines en poids ouverts. Annoncer une génération phare sans ce composant disponible — alors que les concurrents sortent des modèles d'image chaque semaine — laisse les créateurs face à des affirmations qu'ils ne peuvent pas tester.
La conséquence pratique : vous ne pouvez pas évaluer FLUX 3 pour le travail sur image aujourd'hui, et personne d'autre non plus. Les affirmations qui circulent sur son rendu de texte, sa cohérence des personnages ou son respect du prompt ne reposent sur aucune évaluation indépendante. Considérez-les comme du marketing tant que le modèle n'est pas testable.
FLUX 3 Video : 20 secondes avec audio natif
Le composant qui a bel et bien été livré — aux candidats acceptés en accès anticipé — est le plus intéressant. FLUX 3 Video génère des clips allant jusqu'à 20 secondes avec un audio nativement synchronisé, au lieu de produire une vidéo muette puis de la sonoriser après coup. Il couvre aussi l'image vers vidéo, le keyframe vers vidéo et l'enchaînement multi-plans.
Vingt secondes avec son natif, c'est une durée significative. La plupart des modèles vidéo phares restent calibrés autour de clips de 5 à 10 secondes, et c'est précisément dans l'assemblage de ces clips en un ensemble cohérent que part une grande partie du temps de production. Si FLUX 3 tient la continuité du personnage et de l'audio sur 20 secondes, c'est un vrai changement de workflow.
Cela vous indique aussi où BFL situe le marché en croissance. Une maison d'image fixe qui construit l'image vers vidéo et l'enchaînement de plans est une entreprise qui cherche à posséder tout le pipeline, pas seulement la première image.
Lire honnêtement le tableau de benchmarks de BFL
BFL a publié des taux de préférence de FLUX 3 Video face à huit concurrents. Avant de les lire, notez les quatre réserves que BFL y attache lui-même : les chiffres sont auto-déclarés, préliminaires, mesurés en cours d'entraînement intermédiaire, sur des clips de 10 secondes en 720p. Aucune vérification indépendante.

Deux choses sautent aux yeux.
Les victoires sont remportées face aux modèles les plus éloignés de la frontière. Le chiffre de 93 % concerne Luma Ray 3.2 et celui de 77 % Runway Gen-4.5. Ce sont les écarts les plus larges du graphique, et ce sont aussi les deux comparaisons où la barre est la plus basse.
Face à la frontière actuelle, c'est une égalité. FLUX 3 a été préféré dans 52 % des comparaisons face à Seedance 2.0 et dans 52 % face à Gemini Omni Flash. Dans un test de préférence, 52 %, c'est un pile ou face. Il faut reconnaître à BFL d'avoir publié ces lignes honnêtement plutôt que de les faire disparaître discrètement — mais un pile ou face face à des modèles avec lesquels vous pouvez déjà générer aujourd'hui n'est pas une raison d'attendre une liste d'attente.
Cinq des huit modèles de ce graphique sont dès maintenant dans le sélecteur vidéo d'OmniArt : Grok Imagine, Kling, Happy Horse, Seedance 2.0 et Gemini Omni Flash. Vous pouvez exécuter dès cet après-midi le brief sur lequel BFL a fait ses mesures, et juger vous-même de la ligne de référence.
Note
Les clips ci-dessous sont des rendus Seedance générés sur OmniArt — le modèle face auquel FLUX 3 obtient 52 %. Ils sont là pour montrer la ligne de référence que vous pouvez réellement produire aujourd'hui, pas pour représenter un rendu FLUX 3. Il n'existe aucun échantillon public de FLUX 3 que nous puissions vérifier de façon indépendante.
Self-Flow : la promesse architecturale à suivre
L'idée technique derrière FLUX 3 s'appelle Self-Flow : un flow matching auto-supervisé avec conditionnement du pas de temps par token, publié comme travail de recherche en parallèle du lancement. La promesse est une convergence plus rapide que les approches antérieures d'alignement de représentations, et une architecture unique dans laquelle les entraînements image, vidéo, audio et action se contraignent mutuellement.
Si cela se vérifie, la conséquence intéressante n'est pas un meilleur modèle d'image. C'est que les progrès dans une modalité devraient tirer les autres vers le haut, puisqu'elles partagent la représentation au lieu de vivre dans des tours séparées. C'est le même pari que Google a fait avec la ligne omni de Gemini, mais pris par l'autre bout — Google est venu du langage, BFL vient des pixels.
C'est un pari à suivre. Ce n'est pas encore un résultat exploitable.
Le retour au réel : FLUX.2
Comme FLUX 3 Image n'existe pas publiquement, le modèle d'image FLUX le plus récent réellement utilisable reste FLUX.2, sorti en novembre 2025 et étendu par un palier max en décembre puis par une ligne compacte klein en janvier 2026.
| Variante | Disponibilité | Prix catalogue | Notes |
|---|---|---|---|
| FLUX.2 [max] | API | 0,07 $ / MP | Palier supérieur ; ajoute la génération ancrée avec recherche web en direct |
| FLUX.2 [pro] | API | 0,03 $ / MP | Le choix par défaut économique pour la génération et l'édition |
| FLUX.2 [flex] | API | 0,06 $ / MP | Expose les étapes et le guidage ; calibré pour la typographie |
| FLUX.2 [dev] 32B | Poids ouverts | Auto-hébergé | Licence non commerciale ; l'usage commercial relève d'un palier payant |
| FLUX.2 [klein] 4B | Poids ouverts | Auto-hébergé | Apache 2.0 — la seule variante sous licence permissive |
Là où FLUX.2 garde l'avantage
- Cohérence multi-références. Huit images de référence via l'API, dix dans le playground. Verrouillez un visage, un produit, un éclairage, et générez une série cohérente. Cela reste son avantage structurel le plus net.
- Couleurs de marque exactes. Lier une valeur hexadécimale à un objet nommé est une fonctionnalité documentée et de premier ordre. Rattachez la valeur à l'objet — « la voiture est #FF0000 » — plutôt que de la laisser flotter dans le prompt.
- Photoréalisme des matières. Diffusion sous-surfacique de la peau, comportement spéculaire du verre et du métal, façon dont un tissu absorbe ou renvoie la lumière.
- Génération ancrée sur [max]. Recherche web en direct pendant la génération, pour les produits actuels et les événements récents. Rien d'autre dans son palier ne le fait.
Là où il a décroché
Le tableau des préférences à l'aveugle est moins flatteur. Sur l'arène texte vers image d'Artificial Analysis, FLUX.2 [max] se situe actuellement autour de la 16e place, derrière GPT Image 2, la famille Nano Banana 2 et Seedream 5.0 Pro. FLUX.2 [dev] — le vaisseau amiral ouvert en 32B — passe derrière Qwen Image 2.0 Pro, un modèle de 7B sous Apache 2.0.
D'autres frictions à connaître avant d'engager un pipeline dessus :
- Pas de prompts négatifs. Reformulez tout positivement. « Mise au point nette sur toute l'image » plutôt que « pas de flou ».
- Limites de licence. Les poids [dev] en 32B sont non commerciaux. Seule la variante klein en 4B est sous Apache 2.0.
- Coût matériel. Le [dev] en pleine précision, avec son encodeur de texte Mistral de 24B, dépasse très largement la VRAM grand public ; la communauté tourne sur des builds quantifiées, avec perte de qualité.
- Plaintes sur l'anatomie. Les mains et les interactions à plusieurs personnages reviennent régulièrement dans les discussions communautaires, en particulier sur les variantes klein distillées avec leur faible nombre d'étapes par défaut.
Des schémas de prompt qui restent valables
Les recommandations de prompting publiées par BFL pour FLUX.2 sont de bons conseils de métier, transposables à la plupart des modèles d'image modernes, y compris ceux disponibles sur OmniArt.
Structurez en Sujet + Action + Style + Contexte. L'ordre des mots pèse ; commencez par ce qui compte le plus. Trente à quatre-vingts mots, c'est la zone idéale documentée.
Mettez le texte littéral entre guillemets. The text 'OPEN' appears in red neon letters — puis précisez l'emplacement, la graisse et la couleur.
Décrivez les polices, ne les nommez pas. « Sans-serif géométrique en gras, avec un crénage légèrement élargi » fonctionne bien plus fiablement que de citer un nom de police.
Attribuez un rôle à chaque image de référence. Dites quelle entrée fournit le sujet, laquelle fournit le style et laquelle fournit l'arrière-plan.
Utilisez du JSON quand vous devez versionner un brief. Figez la structure, changez exactement une clé par variante, et vous obtenez une comparaison contrôlée plutôt qu'un tirage au hasard :
{
"scene": "Studio product photography on polished concrete",
"subjects": [{ "description": "Matte black ceramic mug, steam rising", "position": "center foreground" }],
"style": "Ultra-realistic commercial product photography",
"color_palette": ["matte black", "concrete gray", "soft white highlights"],
"lighting": "Three-point softbox, soft diffused highlights, no harsh shadows",
"camera": { "angle": "high", "lens-mm": 85, "f-number": "f/5.6" }
}
Astuce
L'habitude la plus rentable du guide de BFL, c'est la reformulation positive. Au lieu de « phares pas sur le sujet », écrivez « phares dirigés vers le bout de la route, éclairant l'asphalte mouillé devant, laissant la silhouette en léger contre-jour ». Cela fonctionne sur tous les modèles, pas seulement sur FLUX.
Que faire cette semaine
Si vous attendiez FLUX 3 pour démarrer un projet, le conseil honnête est de ne pas attendre. Le modèle d'image n'a pas de date, et le modèle vidéo est verrouillé derrière une candidature sans tarif publié.
| Si vous vouliez FLUX 3 pour… | Faites ceci aujourd'hui |
|---|---|
| Photos fixes photoréalistes et packshots produit | GPT Image 2 ou Seedream 5.0 Pro dans le sélecteur d'images d'OmniArt |
| Cohérence de personnage multi-références | Seedream 5.0 Pro, qui accepte jusqu'à 10 images de référence |
| Mises en page et affiches chargées en texte | GPT Image 2 — actuellement le meilleur sur le texte dans l'image |
| Clips longs avec son synchronisé | Seedance 2.0 ou Gemini Omni Flash, tous deux disponibles |
| Une image que vous aimez déjà, mise en mouvement | N'importe quel modèle image vers vidéo d'OmniArt |
La dernière ligne est celle que l'on sous-estime le plus. Le pipeline que BFL cherche à posséder — générer une image fixe, puis l'animer — fonctionne déjà de bout en bout dans un seul espace de travail. Notre guide des modèles image vers vidéo explique quel modèle choisir pour quel type de mouvement, et le guide des prompts Seedance montre comment diriger un plan au lieu de simplement le décrire.
Décrit
Dirigé
Ce qu'il faut surveiller ensuite
Trois signaux vous diront si FLUX 3 mérite qu'on y revienne.
- L'ouverture de l'accès anticipé à FLUX 3 Image, avec les spécifications. Le nombre d'images de référence, la résolution native et le tarif sont les chiffres qui décideront de sa compétitivité.
- Des benchmarks indépendants pour FLUX 3 Video. Des tests de préférence menés par l'éditeur en cours d'entraînement intermédiaire sont un point de départ, pas un résultat. Le vrai test, c'est le classement en arène face à Seedance et à la ligne omni de Gemini.
- La licence des poids ouverts. FLUX.2 [dev] était non commercial, et cette seule décision a coûté à BFL une grande part de sa position open source. Que FLUX 3 Dev répète ou non ce choix décidera du retour de l'écosystème local.
Démarrer sur OmniArt
Vous n'avez pas besoin de choisir un camp dans le déploiement de FLUX 3 pour créer quelque chose cette semaine. OmniArt réunit la génération d'images, de vidéos, d'audio et de musique dans un seul espace de travail, avec les modèles phares du moment — GPT Image 2, Nano Banana, Seedream, Seedance, Kling, Veo, Grok Imagine et Gemini Omni Flash — derrière un unique sélecteur et un unique solde de crédits.
C'est la réponse concrète à un lancement verrouillé : vous évaluez les modèles sur votre propre brief plutôt que sur le graphique d'un éditeur, et vous changez dès que quelque chose de réellement meilleur sort. Quand FLUX 3 Image deviendra testable, nous le passerons sur les mêmes briefs et publierons la comparaison. En attendant, voyez tous les modèles vidéo dans un seul espace de travail pour ce qui est disponible aujourd'hui.
Prêt à créer ?
Commencez à générer du contenu incroyable avec l’IA