FLUX 3 uitgelegd: wat er echt uitkwam en wat niet
FLUX 3 landde op 23 juli 2026 met video van 20 seconden en native audio — maar zonder beeldmodel. Wat er uitkwam, wat de benchmarks werkelijk zeggen en wat je vandaag gebruikt.

Black Forest Labs kondigde FLUX 3 aan op 23 juli 2026 en noemde het een multimodaal frontiermodel voor visuele intelligentie. Twee dagen later is de kop die er voor de meeste makers toe doet niet wat FLUX 3 kan — maar wat je er daadwerkelijk mee kunt draaien. FLUX 3 Video zit achter een aanmeldformulier. FLUX 3 Action zit achter een partnerovereenkomst. En FLUX 3 Image, het deel waar de naam FLUX op is gebouwd, is helemaal niet uitgebracht.
Dat gat is het verhaal. Het bedrijf dat beeldgeneratie met open gewichten tot een serieuze optie maakte, bracht een vlaggenschip uit waarin de beeldhelft het ontbrekende stuk is, en richtte de rest van de aankondiging op video, audio en robotica. Het is een echte koerswijziging, en ze zegt iets over waar in deze markt de druk zit.
Dit stuk scheidt de aankondiging van het product: wat er vandaag bestaat, wat de benchmarkcijfers van BFL wel en niet bewijzen, wat de architectuurclaim precies inhoudt, en waar je naar grijpt zolang FLUX 3 Image achter de wachtlijst blijft.
Wat Black Forest Labs daadwerkelijk aankondigde
FLUX 3 wordt gepresenteerd als één modelfamilie die gezamenlijk is getraind op beeld, video, audio en actie, in plaats van als vier losse systemen. De aankondiging behandelt FLUX 3 Video, FLUX 3 Image, FLUX 3 Action (met een robotica-variant genaamd FLUX-mimic) en een toekomstige FLUX 3 Dev met open gewichten.
De beschikbaarheid is een heel andere tabel.

Waarschuwing
Er is geen openbare prijs voor FLUX 3, geen gepubliceerd aantal parameters, geen technisch rapport voor de modelfamilie en geen licentievoorwaarden voor de beloofde release met open gewichten. Elk specificatieoverzicht dat je tegenkomt met de resolutie van FLUX 3 Image, het maximale aantal referentieafbeeldingen of de kosten per afbeelding is extrapolatie, geen documentatie.
Het beeldmodel is het ontbrekende stuk
BFL schrijft zelf dat FLUX 3 Image “in de komende weken” een fase met early access krijgt. Dat is de volledige publieke toezegging. Geen datum, geen specificaties, geen benchmark.
Dat weegt zwaarder dan een gewone gefaseerde uitrol, want beeldgeneratie is waar het merk FLUX voor staat. FLUX.1 en de Kontext-bewerkingslijn werden een standaard in pijplijnen met open gewichten. Een vlaggenschipgeneratie aankondigen zonder dat onderdeel beschikbaar — terwijl concurrenten wekelijks beeldmodellen uitbrengen — laat makers achter met claims die ze niet kunnen testen.
Het praktische gevolg: je kunt FLUX 3 vandaag niet beoordelen op beeldwerk, en niemand anders ook. Claims die rondgaan over de tekstweergave, de consistentie van personages of het opvolgen van prompts hebben geen onafhankelijke evaluatie achter zich. Behandel ze als marketing tot het model te testen is.
FLUX 3 Video: 20 seconden met native audio
Het onderdeel dat wél uitkwam — voor goedgekeurde aanmelders voor early access — is het werkelijk interessante. FLUX 3 Video genereert clips tot 20 seconden met audio die native gesynchroniseerd is, in plaats van stille video die achteraf van geluid wordt voorzien. Het dekt daarnaast beeld-naar-video, keyframe-naar-video en het aaneenschakelen van multi-shot-ketens.
Twintig seconden met eigen geluid is een betekenisvolle lengte. De meeste vlaggenschipmodellen voor video zijn nog steeds afgestemd op clips van 5 tot 10 seconden, en die aan elkaar plakken tot iets samenhangends is waar veel productietijd in gaat zitten. Houdt FLUX 3 personage- en audiocontinuïteit vast over 20 seconden, dan is dat een echte verandering in de workflow.
Het vertelt je ook wat BFL als groeimarkt ziet. Een huis voor stilstaand beeld dat beeld-naar-video en shotketens bouwt, is een bedrijf dat de hele pijplijn wil bezitten en niet alleen het eerste frame.
De benchmarktabel van BFL eerlijk lezen
BFL publiceerde voorkeurspercentages voor FLUX 3 Video tegen acht concurrenten. Let voor je ze leest op de vier voorbehouden die BFL er zelf bij zet: de cijfers zijn door henzelf gerapporteerd, voorlopig, gemeten halverwege de training, op clips van 10 seconden op 720p. Er is geen onafhankelijke verificatie.

Twee dingen springen eruit.
De overwinningen zijn tegen de modellen die het verst van de frontier staan. Het cijfer van 93% is tegen Luma Ray 3.2 en de 77% tegen Runway Gen-4.5. Dat zijn de breedste marges in de grafiek, en het zijn ook de twee vergelijkingen waar de lat het laagst ligt.
Tegen de huidige frontier is het gelijkspel. FLUX 3 kreeg in 52% van de vergelijkingen tegen Seedance 2.0 de voorkeur en in 52% tegen Gemini Omni Flash. In een voorkeurstest is 52% kop of munt. Alle lof voor BFL dat het dat eerlijk publiceert in plaats van die rijen stilletjes te schrappen — maar kop of munt tegen modellen waarmee je vandaag al kunt genereren, is geen reden om op een wachtlijst te wachten.
Vijf van de acht modellen in die grafiek zitten op dit moment in de videokiezer van OmniArt: Grok Imagine, Kling, Happy Horse, Seedance 2.0 en Gemini Omni Flash. Je kunt de briefing waarop BFL heeft gebenchmarkt vanmiddag nog draaien en het uitgangspunt zelf beoordelen.
Let op
De clips hieronder zijn output van Seedance, gegenereerd op OmniArt — het model waartegen FLUX 3 52% scoorde. Ze staan hier om het huidige uitgangspunt te tonen dat je vandaag echt kunt produceren, niet om output van FLUX 3 te vertegenwoordigen. Er bestaan geen openbare voorbeelden van FLUX 3 die wij onafhankelijk kunnen verifiëren.
Self-Flow: de architectuurclaim die het volgen waard is
Het technische idee achter FLUX 3 heet Self-Flow — zelfgesuperviseerde flow matching met conditionering op tijdstap per token, samen met de lancering als onderzoek gepubliceerd. De claim is snellere convergentie dan eerdere aanpakken op basis van representatie-uitlijning, plus één onderliggende architectuur waarin training op beeld, video, audio en actie elkaar beperkt.
Klopt dat, dan is het interessante gevolg niet een beter beeldmodel. Het is dat verbeteringen in de ene modaliteit de andere zouden moeten optillen, omdat ze de representatie delen in plaats van in aparte torens te zitten. Dat is dezelfde inzet die Google met de Gemini-omnilijn deed, maar dan uit de tegenovergestelde richting — Google kwam vanuit taal, BFL komt vanuit pixels.
Een inzet die het volgen waard is. Nog geen resultaat dat je kunt gebruiken.
De realiteitscheck van FLUX.2
Omdat FLUX 3 Image publiek niet bestaat, is het nieuwste bruikbare FLUX-beeldmodel nog steeds FLUX.2, dat in november 2025 uitkwam en in december werd uitgebreid met een max-variant en in januari 2026 met een compacte klein-lijn.
| Variant | Beschikbaarheid | Adviesprijs | Opmerkingen |
|---|---|---|---|
| FLUX.2 [max] | API | $0,07 / MP | Topvariant; voegt generatie toe met live zoekopdrachten op het web |
| FLUX.2 [pro] | API | $0,03 / MP | De kostenefficiënte standaard voor genereren en bewerken |
| FLUX.2 [flex] | API | $0,06 / MP | Ontsluit stappen en guidance; afgestemd op typografie |
| FLUX.2 [dev] 32B | Open gewichten | Zelf hosten | Niet-commerciële licentie; commercieel gebruik is betaald |
| FLUX.2 [klein] 4B | Open gewichten | Zelf hosten | Apache 2.0 — de enige variant met een permissieve licentie |
Waar FLUX.2 nog steeds wint
- Consistentie over meerdere referenties. Acht referentieafbeeldingen via de API, tien in de playground. Zet een gezicht, een product en een lichtopstelling vast en genereer een samenhangende serie. Dit blijft het duidelijkste structurele voordeel.
- Kleur exact volgens de huisstijl. Hexwaarden gekoppeld aan een benoemd object zijn een gedocumenteerde, volwaardige functie. Koppel de waarde aan het ding — "the car is #FF0000" — in plaats van hem los in de prompt te laten zweven.
- Fotorealisme van materialen. Onderhuidse lichtverstrooiing in huid, spiegelend gedrag op glas en metaal, hoe stof licht opneemt of juist weerkaatst.
- Generatie met webgrond op [max]. Live zoeken op het web tijdens het genereren, voor actuele producten en recente gebeurtenissen. Niets anders in die klasse doet dit.
Waar het achterop is geraakt
Het beeld uit blinde voorkeurstests is minder vleiend. In de tekst-naar-beeldarena van Artificial Analysis staat FLUX.2 [max] momenteel rond de zestiende plek, achter GPT Image 2, de Nano Banana 2-familie en Seedream 5.0 Pro. FLUX.2 [dev] — het open vlaggenschip van 32B — staat onder Qwen Image 2.0 Pro, een Apache-2.0-model van 7B.
Andere wrijving die je moet kennen voordat je er een pijplijn op bouwt:
- Geen negatieve prompts. Herschrijf alles positief. "Sharp focus throughout" in plaats van "no blur."
- Licentiegrenzen. De gewichten van [dev] 32B zijn niet-commercieel. Alleen de klein-variant van 4B valt onder Apache 2.0.
- Hardwarekosten. [dev] op volledige precisie plus de Mistral-tekstencoder van 24B gaat ver voorbij consumenten-VRAM; de community draait gekwantiseerde builds met kwaliteitsverlies.
- Klachten over anatomie. Handen en interactie tussen meerdere personen zijn terugkerende faalpunten in communitydraadjes, vooral op de gedistilleerde klein-varianten bij hun standaard lage aantal stappen.
Promptpatronen die meegaan
De gepubliceerde promptadviezen van BFL voor FLUX.2 zijn goed vakmanschap dat overdraagt naar de meeste moderne beeldmodellen, inclusief die op OmniArt.
Structureer als Subject + Action + Style + Context. De woordvolgorde weegt mee; begin met wat het zwaarst telt. Dertig tot tachtig woorden is de gedocumenteerde ideale lengte.
Citeer letterlijke tekst. The text 'OPEN' appears in red neon letters — en geef daarna plaatsing, gewicht en kleur op.
Beschrijf lettertypen, noem ze niet. "Bold geometric sans-serif with slightly extended kerning" komt veel betrouwbaarder aan dan het benoemen van een lettertype.
Geef elke referentieafbeelding een rol. Zeg welke invoer het onderwerp levert, welke de stijl en welke de achtergrond.
Gebruik JSON wanneer je een briefing wilt versioneren. Zet de structuur vast, verander precies één sleutel per variant, en je krijgt een gecontroleerde vergelijking in plaats van een nieuwe worp:
{
"scene": "Studio product photography on polished concrete",
"subjects": [{ "description": "Matte black ceramic mug, steam rising", "position": "center foreground" }],
"style": "Ultra-realistic commercial product photography",
"color_palette": ["matte black", "concrete gray", "soft white highlights"],
"lighting": "Three-point softbox, soft diffused highlights, no harsh shadows",
"camera": { "angle": "high", "lens-mm": 85, "f-number": "f/5.6" }
}
Tip
De gewoonte met de hoogste opbrengst uit de gids van BFL is positief herschrijven. Schrijf in plaats van "headlights not on the subject" liever "headlights pointing down the road, illuminating the wet asphalt ahead, leaving the figure in soft silhouette." Dat werkt op elk model, niet alleen op FLUX.
Wat je deze week doet
Wachtte je op FLUX 3 om een project te starten, dan is het eerlijke advies: niet wachten. Het beeldmodel heeft geen datum, en het videomodel zit achter een aanmelding zonder gepubliceerde prijzen.
| Wilde je FLUX 3 voor… | Doe vandaag dit |
|---|---|
| Fotorealistisch stilstaand beeld en productwerk | GPT Image 2 of Seedream 5.0 Pro in de beeldkiezer van OmniArt |
| Consistente personages over meerdere referenties | Seedream 5.0 Pro, dat tot 10 referentieafbeeldingen aanneemt |
| Lay-outs en posters met veel tekst | GPT Image 2 — de huidige koploper in tekst in beeld |
| Lange clips met gesynchroniseerd geluid | Seedance 2.0 of Gemini Omni Flash, allebei nu beschikbaar |
| Een stilstaand beeld dat je al mooi vindt, in beweging brengen | Elk beeld-naar-videomodel op OmniArt |
De laatste rij is degene die de meeste mensen onderschatten. De pijplijn die BFL wil bezitten — een stilstaand beeld genereren en het daarna animeren — werkt al van begin tot eind in één werkruimte. Onze gids voor beeld-naar-videomodellen behandelt welk model bij welk soort beweging past, en de Seedance-promptgids laat zien hoe je een shot regisseert in plaats van het alleen beschrijft.
Beschreven
Geregisseerd
Wat je hierna in de gaten houdt
Drie signalen vertellen je of FLUX 3 een tweede blik waard is.
- De opening van early access voor FLUX 3 Image, met specificaties. Het aantal referentieafbeeldingen, de native resolutie en de prijs zijn de getallen die bepalen of het meedoet.
- Onafhankelijke benchmarks voor FLUX 3 Video. Voorkeurstests van de aanbieder zelf, gemeten halverwege de training, zijn een startpunt en geen resultaat. Een positie in de arena tegen Seedance en de Gemini-omnilijn is de echte test.
- De licentie voor de open gewichten. FLUX.2 [dev] was niet-commercieel, en die ene beslissing kostte BFL een groot deel van zijn positie in open source. Of FLUX 3 Dev dat herhaalt, bepaalt of het lokale ecosysteem terugkomt.
Aan de slag op OmniArt
Je hoeft in de uitrol van FLUX 3 geen kant te kiezen om deze week iets te maken. OmniArt houdt beeld-, video-, audio- en muziekgeneratie in één werkruimte, met de huidige vlaggenschipmodellen — GPT Image 2, Nano Banana, Seedream, Seedance, Kling, Veo, Grok Imagine en Gemini Omni Flash — achter één kiezer en één tegoed.
Dat is het praktische antwoord op een afgeschermde lancering: je beoordeelt modellen tegen je eigen briefing in plaats van tegen de grafiek van een aanbieder, en je wisselt zodra er echt iets beters uitkomt. Zodra FLUX 3 Image te testen is, draaien we het tegen dezelfde briefings en publiceren we de vergelijking. Tot die tijd laat elk videomodel in één werkruimte zien wat er vandaag beschikbaar is.
Klaar om te maken?
Ga aan de slag en genereer content met AI