GPT-6.1 Sol are now live on CometAPI →
ai-model/CometAPI research

Wat is FLUX 3? Specificaties, benchmarks, functies, prijzen en API-toegang

Ontdek het multimodale AI-model van Black Forest Labs, inclusief FLUX 3-specificaties, benchmarks, functies, prijzen, de Self-Flow-architectuur, concurrenten en API-toegang.

CometAPI
Deon GoodwinOnderzoeksteam voor AI-modellen en API
Bijgewerkt Oct 3, 2026 18 min leestijd
Wat is FLUX 3? Specificaties, benchmarks, functies, prijzen en API-toegang
Gebruik dit patroon

Doe de eerste API-aanroep.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR: FLUX 3 is het uniforme multimodale foundationmodel van Black Forest Labs. De openbaar beschikbare Video API genereert clips tot 20 seconden bij 24 fps, met optioneel gesynchroniseerd geluid, op basis van tekst, afbeeldingen, keyframes of bestaande video. Het ondersteunt resoluties van HD tot en met UHD/4K, terwijl FLUX 3 Image en het open-weight model FLUX 3 Dev afzonderlijke uitrolitems blijven.

Wat is FLUX 3?

FLUX 3 is een toonaangevend multimodaal model van Black Forest Labs. In plaats van onafhankelijk één model voor beelden, een ander voor video en weer een ander voor audio te trainen, traint BFL een gedeelde representatie over deze modaliteiten.

Het kernidee is dat beelden, video en geluid verschillende observaties zijn van dezelfde onderliggende wereld. Een rijdende auto heeft een visueel uiterlijk, beweging, geluid, ruimtelijke relaties, materiaaleigenschappen en causaal gedrag. Deze signalen samen leren geeft het model meer beperkingen dan het afzonderlijk leren van individuele frames.

Daarom beschrijft Black Forest Labs FLUX 3 als een stap richting een reality model of wereldmodel in plaats van louter een beeld- of videogenerator. Het vrijgegeven videosysteem toont die richting al: gesynchroniseerd geluid, beweging, scènestructuur, dialoog, cameragedrag en omgevingsgeluiden worden in één generatieworkflow afgehandeld.

Niet elke aangekondigde FLUX 3-functionaliteit is al openbaar beschikbaar. Per september 2026 is FLUX 3 Video beschikbaar, terwijl FLUX 3 Image en het open-weight model FLUX 3 Dev afzonderlijke uitrolitems blijven.

FLUX 3-specificaties in één oogopslag

De onderstaande specificaties weerspiegelen de huidige FLUX 3-ontwikkelaarsdocumentatie en niet de voorlopige configuratie van de lancering in juli.

SpecificatieOfficiële FLUX 3-documentatie
OntwikkelaarBlack Forest Labs
ModelfamilieFLUX 3
ModeltypeUniform multimodaal foundation-/generatief videomodel
Publieke videorelease4 augustus 2026
KerntrainingsrichtingGezamenlijk leren van beeld-, video- en audiorepresentaties
OnderzoeksfundamentSelf-Flow
Huidige primaire API-outputVideo met gesynchroniseerd geluid
Tekst-naar-videoOndersteund
Afbeelding-naar-videoOndersteund
Keyframe-naar-videoOndersteund
VideovervolgOndersteund
Maximale T2V/I2V-duur20 seconden
Duur videovoorzetting5–15 seconden
Framerate24 fps
ResolutieHD, FHD, QHD/2K en UHD/4K
FHD-resolutie 16:91920 × 1088
AfbeeldingsreferentiesTot 10 voor I2V/keyframe-workflows
Natieve audioJa
Meertalige dialoogJa
LipsynchronisatieJa
Generatie met meerdere shotsJa
Draft ModeJa
Publiek FLUX 3-eindpunt voor stilstaande beeldenNog niet algemeen door BFL uitgebracht
Open-weight FLUX 3 DevGepland

De huidige BFL-documentatie specificeert 5–20 seconden voor tekst-naar-video en afbeelding-naar-video, terwijl videovoorzetting een venster van 5–15 seconden accepteert. Ondersteunde beeldverhoudingen zijn 21:9, 2:1, 16:9, 4:3, 1:1, 3:4 en 9:16.

Hoe werkt FLUX 3?

Self-Flow

De belangrijkste onderzoeksbasis is Self-Flow, BFL’s zelfsupervisie-gebaseerde flow-matchingbenadering. Traditionele generatieve trainingspijplijnen vertrouwen vaak op afzonderlijke voorgetrainde representatiemodellen of aanvullende supervisie. Self-Flow is ontworpen om nuttige representaties direct vanuit de generatieve doelstelling te leren.

Een belangrijk mechanisme is Dual-Timestep Scheduling. Verschillende groepen tokens kunnen tijdens training verschillende ruisniveaus krijgen toegewezen. Dit creëert informatie-asymmetrie: sommige delen van de input bevatten meer bruikbare informatie dan andere, waardoor het netwerk representaties opbouwt die helpen af te leiden wat ontbreekt.

In de praktijk wordt FLUX 3 gestimuleerd om relaties te leren tussen objecten, frames, beweging, geluid en temporele gebeurtenissen in plaats van simpelweg te onthouden hoe individuele frames eruit zouden moeten zien.

Wat is FLUX 3? Specificaties, benchmarks, functies, prijzen en API-toegang

Architectuur van de Self-Flow-methode - officiële afbeeldingsbron: Black Forest Labs Self-Flow-project

BFL testte ook gezamenlijke multimodale training met een op FLUX.2 gebaseerde backbone met miljoenen video’s en honderden miljoenen afbeeldingen. De experimenten ondersteunen de bredere FLUX 3-hypothese dat representatieleren en generatie geen gescheiden systemen hoeven te zijn.

Waarom video centraal staat in FLUX 3

Video is bijzonder waardevol voor wereldmodellering omdat het informatie bevat die een stilstaand beeld niet kan bieden. Een enkel frame kan een bal boven de vloer tonen; een video kan laten zien dat de bal valt, stuitert, vervormt bij impact, geluid maakt en daarna van richting verandert.

BFL maakte bekend dat videovoorspelling voor meer dan 95% van FLUX 3’s trainingsrekenwerk zorgt. Audio is relatief goedkoop omdat het een veel lager-dimensionaal signaal is dat nauw gekoppeld is aan zichtbare gebeurtenissen. Die verdeling helpt verklaren waarom video de eerste FLUX 3-functionaliteit is die algemeen beschikbaar kwam.

Wat kan FLUX 3?

Tekst-naar-video

Gebruikers kunnen een complete video genereren op basis van natuurlijke taal. BFL zegt dat het vrijgegeven model zowel eenvoudige als complexe prompts verwerkt en beweging, scenelogica, visuele compositie en geluid coördineert. Dit is vooral nuttig voor prompts met meerdere opeenvolgende gebeurtenissen in plaats van één enkel geanimeerd onderwerp.

Afbeelding-naar-video en keyframes

FLUX 3 kan een beginbeeld animeren, naar een eindframe toewerken of meerdere afbeeldingen als getimede keyframes gebruiken. De huidige API ondersteunt tot tien afbeeldingsreferenties in afbeelding-naar-video-workflows, zodat makers kunnen sturen hoe een scène in de tijd verandert in plaats van het model de volledige sequentie te laten improviseren.

Videovoorzetting

Een bestaande video en het bijbehorende geluid kunnen als context worden aangeleverd en FLUX 3 kan genereren wat er daarna gebeurt. BFL beschrijft een voortzetting die beweging, cameragedrag, dialoog en geluid over de overgang heen behoudt, wat wezenlijk anders is dan een tweede, onafhankelijke clip genereren en de twee bestanden achteraf samenvoegen.

Natieve audio en dialoog

FLUX 3 produceert audio tijdens de generatie, zonder een aparte spraak- of geluidsgeneratiepass nodig te hebben. De vrijgegeven audiomogelijkheden omvatten dialoog, geluidseffecten en omgevingsgeluid. Meertalige dialoog met lipsynchronisatie wordt ook ondersteund.

Meerdere shots in één generatie

Een enkele prompt kan meerdere scènes of camerahoeken bevatten. Dit is belangrijk omdat veel eerdere videomodellen het sterkst zijn wanneer ze om één korte, visueel continue shot worden gevraagd; FLUX 3 is expliciet ontworpen om multishot-sequenties binnen één generatie te ondersteunen.

Draft Mode

Draft Mode is een van de praktischere toevoegingen voor grootschalige videogeneratie. In plaats van de volledige prijs te betalen voor elke promptproef, kunnen ontwikkelaars een snellere, goedkopere preview maken en vervolgens de geselecteerde schets verbeteren met behoud van de gekozen compositie en beweging. Volgens de huidige BFL-prijzen kost een standaard T2V/I2V-concept $0.06 per seconde, tegenover $0.17 per seconde voor reguliere HD-generatie.

Wat is nog niet verscheept?

De lancering van FLUX 3 beschreef beeld-, video-, audio- en actiecapaciteiten onder één architecturale richting, maar de beschikbaarheid is gefaseerd.

MogelijkheidHuidige BFL-roadmap en beschikbaarheid
FLUX 3-videogeneratieAlgemeen beschikbaar
Natieve video-audioAlgemeen beschikbaar
Tekst-naar-videoAlgemeen beschikbaar
Afbeelding-naar-video / keyframesAlgemeen beschikbaar
VideovoorzettingAlgemeen beschikbaar
Rijkere combinaties van beeld-/video-/audioreferentiesGeplande uitbreiding
FLUX 3 Image-generatie en -bewerkingAankomend
FLUX 3 Dev open weightsGepland
Implementatie van actievoorspellingOnderzoek / traject met commerciële partners

Dit onderscheid is vooral belangrijk voor gebruikers die bekend zijn met FLUX.2 Max. FLUX.2 blijft een huidige, dedicated optie voor stilstaandebeeldgeneratie, terwijl het publieke FLUX 3-product is gericht op video en audio.

FLUX 3-benchmarkprestaties

Er zijn nu twee nuttige vormen van FLUX 3-benchmarkbewijslast: BFL’s interne evaluatie na release en onafhankelijke evaluatie door derden. De eerste toont relatieve menselijke voorkeur onder BFL’s protocol; de tweede controleert of die sterktes zichtbaar blijven onder een apart ontworpen benchmark.

BFL ELO-evaluatie na release

De eerste aankondiging in juli bevatte voorlopige winstpercentages. De relevantere benchmark voor huidige gebruikers is BFL’s evaluatie van 4 augustus van het uitgebrachte model. Black Forest Labs meldt een tekst-naar-video ELO-score van 1135 in een interne all-vs-all-evaluatie.

Wat is FLUX 3? Specificaties, benchmarks, functies, prijzen en API-toegang

ELO-evaluatie van het vrijgegeven FLUX 3-model - officiële afbeeldingsbron: Black Forest Labs

MetriekBFL-evaluatie van vrijgegeven model
Tekst-naar-video ELO1135
T2V-positieHoogste score in BFL’s geteste groep
I2V-resultaatGelijk aan de sterkste geteste concurrent en beter dan de overige modellen
Type evaluatieInterne evaluatie op basis van menselijke voorkeur
ModelfaseAlgemeen beschikbare FLUX 3 Video-release

Dit is sterker bewijs dan de voorlopige benchmark bij de lancering, omdat de vrijgegeven augustusversie wordt geëvalueerd. Het blijft echter een door de leverancier uitgevoerde benchmark en moet niet worden geïnterpreteerd als bewijs dat FLUX 3 elke concurrent op elke promptcategorie zal overtreffen.

Onafhankelijke FLUX 3-benchmark

Megaton’s v-benchmark v2 biedt een onafhankelijke controle. FLUX 3 werd geëvalueerd in augustus 2026 en noteert momenteel een Megaton Index van 76.51/100, goed voor plaats #3 in de gepubliceerde set ten tijde van de evaluatie.

BenchmarkdimensieMegaton-evaluatie FLUX 3
Megaton Index76.51
Prompt-naleving87.07
Scèneconsistentie94.76
Fysica70.63
Menselijke getrouwheid73.70
Object- & productgetrouwheid83.82
Causale & semantische coherentie80.91
Tekstgetrouwheid82.41
Cinematografie71.43
Smaak & art direction65.00

Het profiel is informatiever dan de totaalscore. Scèneconsistentie van 94.76 is de sterkste grote categorie, terwijl prompt-naleving, objectgetrouwheid, causale coherentie en tekstgetrouwheid ook boven 80 uitkomen. Fysica, menselijke getrouwheid en smaak & art direction zijn zwakker, wat laat zien dat sterkere temporele representatie synthetische beweging of variatie in artistieke kwaliteit niet elimineert.

Dit verklaart ook waarom benchmarkconclusies kunnen verschillen: BFL’s interne voorkeurstest plaatst FLUX 3 bovenaan zijn vergelijkingsset, terwijl Megaton’s onafhankelijke ranglijst het op de derde plaats zet. Verschillende prompts, scoringsdimensies, evaluatorpopulaties en aggregatiemethoden kunnen verschillende rangschikkingen opleveren.

FLUX 3 vs Seedance 2.5 vs MiniMax H3 vs Wan 3.0

De AI-videomarkt bewoog zich snel in 2026. FLUX 3 concurreert nu met multimodale systemen die in toenemende mate langvormgeneratie, gesynchroniseerde audio, referenties en bewerking combineren.

DimensieFLUX 3Seedance 2.5MiniMax H3Wan 3.0
OntwikkelaarBlack Forest LabsByteDance SeedMiniMaxAlibaba
Maximale geadverteerde clip20 s30 s15 s30 s
VideoresolutieHD / FHD / QHD (2K) / UHD (4K)Afhankelijk van API-laagTot 2KTot 1080p
Natieve audioJaJaJa, stereoJa
Tekst-naar-videoJaJaJaJa
Afbeelding-/referentie-inputJaJaJaJa
Keyframe-/referentiecontroleSterke getimede keyframesSterke multimodale referentiecontroleMultimodale conditioneringMultimodale referentiecontrole
Videovoorzetting/bewerkingVervolg beschikbaarBewerking-georiënteerde workflowOmni-generatiefocusBewerking- en referentieworkflows
Generatie met meerdere shotsJaJaJaJa
Onderscheidende krachtReality-modelarchitectuur, scèneconsistentie, Self-FlowLangvormverhaal en referentiecontrole2K audiovisuele generatie en omni-modale contextLange clips en lagere startkosten
CometAPI vanaf-/eenheidsprijs*$0.136/s$0.0824/s vermeld$0.064/s$0.040/s

* Prijzen zijn slechts een ruwe vergelijking. Video-API’s hanteren verschillende resoluties, duur, kwaliteitsniveaus en factureringsregels, dus het goedkoopste per-secondegetal is niet per se de goedkoopste output van equivalente kwaliteit.

FLUX 3 vs Seedance 2.5

Seedance 2.5 heeft een duidelijk duurvoordeel, met generaties tot 30 seconden tegenover 20 seconden voor FLUX 3. Het is ook sterk gericht op referentiegestuurde generatie, bewerking en langvormverhalen. FLUX 3 onderscheidt zich door zijn gedeelde wereldmodel-architectuur, scèneconsistentie, native audiovisuele generatie, getimede keyframes en een bredere beeld-/actieroadmap.

Onafhankelijke tests bevestigen dat dit een echte high-end competitie is: Megaton plaatst Seedance 2.5 momenteel boven FLUX 3 in het algemeen.

FLUX 3 vs MiniMax H3

MiniMax H3 biedt tot 2K-uitvoer en native stereogeluid, wat een sterke technische specificatie is voor audiovisuele content. FLUX 3 ondersteunt een langere maximale generatieperiode — 20 seconden tegenover 15 seconden voor H3 — en Draft Mode biedt een kostenbeheersde iteratieworkflow.

FLUX 3 vs Wan 3.0

Wan 3.0 legt de nadruk op brede multimodale input, audiovisuele generatie, bewerking en clips tot 30 seconden. Het is ook goedkoper qua vermelde startprijs bij CometAPI. FLUX 3 is duurder maar onderscheidt zich door zijn reality-modelpositionering, scèneconsistentie, Self-Flow-onderzoeksbasis, Draft Mode en integratie met actievoorspelling.

FLUX 3-prijzen

Black Forest Labs rekent FLUX 3 af op basis van de gegenereerde videoduur.

ModusOfficiële BFL FLUX 3-prijzen
T2V / I2V Draft HD$0.06/s
T2V / I2V HD$0.17/s
T2V / I2V FHD$0.29/s
T2V / I2V QHD (2K)$0.40/s
T2V / I2V UHD (4K)$0.80/s
Videovoorzetting Draft$0.12/s
Videovoorzetting HD$0.41/s
Videovoorzetting FHD$0.53/s
Videovoorzetting QHD (2K)$0.65/s
Videovoorzetting UHD (4K)$0.95/s

Een standaard HD-generatie van 10 seconden kost daarmee ongeveer $1.70, terwijl een FHD-generatie van 10 seconden ongeveer $2.90 kost. Videovoorzetting is substantieel duurder dan gewone generatie, dus toepassingen die vaak clips verlengen, moeten die kosten apart modelleren.

FLUX 3-prijs bij CometAPI

CometAPI vermeldt FLUX 3 momenteel als beschikbaar met model-ID flux-3.

ResolutieCometAPI FLUX 3-prijzen
720p$0.136/s
1080p$0.232/s

Voor een generatie van 10 seconden komt dat neer op ongeveer $1.36 bij 720p of $2.32 bij 1080p. In vergelijking met BFL’s vermelde tarieven van $0.17/s en $0.29/s zijn de standaardprijzen bij CometAPI voor deze twee niveaus circa 20% lager.

Beschikbaarheidsopmerking: sommige oudere beschrijvende teksten op CometAPI weerspiegelen nog de Early Access-periode van juli. De huidige live model card, prijzensectie en API-voorbeeld vermelden flux-3 als Available, met een CometAPI-releasedatum van 13 augustus 2026. Voor integratiebeslissingen zijn de live API- en prijsvelden relevanter dan de oudere beschikbaarheidstekst.

Waarom FLUX 3 ertoe doet buiten AI-video

Het meest ongebruikelijke aan FLUX 3 is niet de 20-seconden-videogeneratie. Verschillende concurrenten kunnen al even lange of langere clips genereren. De grotere technische inzet is dat een sterke videorepresentatie de basis kan worden voor andere vormen van intelligentie.

Van videovoorspelling naar actievoorspelling

Robotbesturingssignalen zijn temporele voorspellingen geconditioneerd op visuele waarnemingen, dus BFL gebruikt de FLUX 3-videorepresentatie als basis voor actievoorspelling. De samenwerking met mimic robotics leverde FLUX-mimic op, waarin een actiedecoder representaties leest uit het videomodel in plaats van een volledig onafhankelijke perceptiestack te trainen.

BFL meldt dat de FLUX-mimic-backbone in minder dan 80 ms kan draaien op één RTX 5090, terwijl het complete robotsysteem een reactielus van ongeveer 101 ms haalt. Het bedrijf heeft ook gesproken over industriële evaluatie met Audi.

Dit maakt de publieke FLUX 3 Video API nog geen robotica-API. Het laat wel zien waarom BFL zwaar investeerde in multimodale videorepresentatie in plaats van videogeneratie als een geïsoleerde mediatak te behandelen.

Wat zijn de belangrijkste sterke punten van FLUX 3?

  • Temporaliteit en scèneconsistentie. Megaton’s score van 94.76 voor scèneconsistentie is de sterkste grote benchmarkcategorie van het model.
  • Natieve audiovisuele generatie. Dialoog, effecten, ambiance en visuals kunnen samen worden gegenereerd in plaats van uit afzonderlijke modellen te worden samengevoegd.
  • Sterke prompt-naleving. De onafhankelijke score van 87.07 voor prompt-naleving suggereert dat de sterke punten verder reiken dan louter visuele afwerking.
  • Keyframecontrole. Tot tien afbeeldingen kunnen deelnemen aan de huidige afbeelding-naar-video-workflows, wat expliciete temporele controle biedt.
  • Draft-to-final workflow. Draft Mode pakt een echt kostenprobleem in AI-video aan: veel generaties worden tijdens promptiteratie weggegooid.
  • Brede visuele range. BFL positioneert FLUX 3 als in staat tot rauwe, natuurlijke, cinematografische, nostalgische, speelse, gestileerde en ongewone outputs in plaats van één vaste huisstijl.
  • Wereldmodel-onderzoeksrichting. Self-Flow en actievoorspelling maken FLUX 3 relevant buiten mediageneratie.

Wat zijn de beperkingen van FLUX 3?

  • De volledige multimodale roadmap is nog niet verscheept. Verwar de publieke FLUX 3 Image en FLUX 3 Dev open weights niet met de familiebrede aankondiging.
  • 20 seconden is niet langer toonaangevende duur. Sommige concurrenten in 2026 ondersteunen al generaties van 30 seconden.
  • Fysica is niet opgelost. Megaton geeft FLUX 3 een fysicascore van 70.63, aanzienlijk lager dan de scèneconsistentiescore.
  • Menselijke getrouwheid kan beter. Een onafhankelijke score van 73.70 betekent dat moeilijke anatomie en realistische menselijke beweging nog kunnen mislukken.
  • Videovoorzetting is duur. BFL’s prijs voor voortzetting is per seconde aanzienlijk hoger dan gewone T2V/I2V.
  • BFL’s opvallende competitieve benchmark is intern. Productiebeslissingen moeten ook onafhankelijke tests omvatten met de eigen prompts, shottypes, talen en referentie-assets van de toepassing.

Hoe gebruik je FLUX 3 met CometAPI

De eerdere FLUX 3-coverage van CometAPI legt de Early Access-fase van juli, voorlopige benchmarks en geplande uitrol uit. Deze sectie richt zich op de huidige productie-integratie, prijzen en de werkende API-flow om die historische walkthrough niet te herhalen. Het FLUX 3-productiemodel gebruikt model-ID flux-3.

Een basisaanvraag voor 720p gebruikt het /v1/videos-eindpunt:

Bash

curl --request POST "https://api.cometapi.com/v1/videos" \
--header "Authorization: Bearer $COMETAPI_KEY" \
--form-string "model=flux-3" \
--form-string "prompt=A paper boat glides across a still pond in soft morning light" \
--form-string "seconds=5" \
--form-string "size=1280x720"

De videoworkflow is asynchroon. Nadat het eerste verzoek een taak-ID retourneert, controleert de toepassing de taak totdat de generatie is voltooid en haalt dan de resulterende video op. Voor productieapplicaties moet generatie normaliter worden afgehandeld door een achtergrondtaak of taakqueue in plaats van een HTTP-verzoek de volledige rendertijd open te houden.

Wie zou FLUX 3 moeten gebruiken?

FLUX 3 is vooral overtuigend voor toepassingen die meer nodig hebben dan visueel aantrekkelijke clips van vijf seconden: advertentiesystemen met gesynchroniseerde beelden en audio, geautomatiseerde shortform-productie, productdemonstraties waarbij objectpersistentie belangrijk is, meertalige dialooggeneratie, storyboard-naar-video-workflows, keyframe-gestuurde animatie, educatieve content en experimenten met langere multimodale pijplijnen.

Het kan minder aantrekkelijk zijn wanneer alleen de laagst mogelijke prijs per seconde vereist is, wanneer meer dan 20 seconden in één keer moeten worden gegenereerd, of wanneer stilstaandebeeldgeneratie de primaire taak is. Voor stilstaande beelden kan een bestaand FLUX-beeldmodel zoals FLUX.2 Max momenteel beter passen.

Is FLUX 3 beter dan andere AI-videomodellen?

Er is geen enkel verdedigbaar antwoord voor elk gebruiksscenario. BFL’s interne evaluatie plaatst de vrijgegeven FLUX 3 bovenaan zijn tekst-naar-video-vergelijking, terwijl de onafhankelijke Megaton-evaluatie FLUX 3 als derde rangschikt achter nieuwere concurrenten. Beide resultaten kunnen kloppen omdat de tests verschillende promptdistributies en kwaliteitsdimensies meten.

FLUX 3 lijkt bijzonder sterk wanneer scèneconsistentie, promptvolging, objectgetrouwheid, causale coherentie, tekstrendering, gesynchroniseerd geluid en controleerbare keyframes belangrijk zijn. Andere modellen kunnen winnen op maximale duur, resolutie, artistieke voorkeuren, menselijke getrouwheid, bewerkingsworkflows of kosten. Voor ontwikkelaars is de juiste vergelijking werklastspecifiek in plaats van leaderboard-specifiek.

Veelgestelde vragen

Is FLUX 3 nu beschikbaar?

Ja. FLUX 3 Video werd per 4 augustus 2026 algemeen beschikbaar via BFL. CometAPI vermeldt FLUX 3 ook als Available onder model-ID flux-3. De release van FLUX 3 Image voor stilstaande beelden en de open weights van FLUX 3 Dev blijven afzonderlijke roadmapitems.

Kan FLUX 3 audio genereren?

Ja. FLUX 3 Video genereert gesynchroniseerde, native audio inclusief dialoog, omgevingsgeluid en effecten. Meertalige dialoog en lipsynchronisatie worden ook ondersteund.

Hoe lang kunnen FLUX 3-video’s zijn?

Huidige tekst-naar-video- en afbeelding-naar-video-generatie ondersteunt 5–20 seconden. Videovoorzetting ondersteunt 5–15 seconden aan nieuw gegenereerde content.

Welke resolutie ondersteunt FLUX 3?

BFL ondersteunt HD (tot 1 megapixel per frame), FHD (tot 2 MP), QHD/2K (tot 4 MP) en UHD/4K (tot 8 MP). Een 16:9 FHD-output is 1920 × 1088. Resolutiebanden zijn gebaseerd op het totaal aantal pixels per frame in plaats van op de beeldverhouding; Draft Mode is alleen HD.

Ondersteunt FLUX 3 afbeelding-naar-video?

Ja. Afbeelding-naar-video en keyframegeneratie maken deel uit van de algemeen beschikbare FLUX 3 Video-functionaliteit.

Is FLUX 3 een beeldgeneratiemodel?

Architectonisch is FLUX 3 getraind op beelden, video en audio, en BFL heeft onderzoek naar beeldgeneratie en -bewerking gedemonstreerd. Het FLUX 3 Image-product blijft echter een komende release; verwar de familieroadmap niet met de momenteel publieke FLUX 3 Video API.

Is FLUX 3 open source?

Op dit moment niet. BFL heeft FLUX 3 Dev aangekondigd, een open-weight multimodale variant, maar heeft nog geen publieke releasedatum gegeven.

Hoeveel kost FLUX 3?

BFL rekent $0.06/s voor Draft HD en daarna $0.17/s voor HD, $0.29/s voor FHD, $0.40/s voor QHD en $0.80/s voor UHD voor tekst-/afbeelding-naar-video. Video-naar-video kost $0.12/s voor Draft HD, daarna $0.41/s voor HD, $0.53/s voor FHD, $0.65/s voor QHD en $0.95/s voor UHD. CometAPI vermeldt momenteel $0.136/s voor 720p en $0.232/s voor 1080p.

Wat is Self-Flow?

Self-Flow is BFL’s zelfsupervisie-gebaseerde flow-matchingonderzoeksaanpak. Het is ontworpen om een generatief model nuttige interne representaties te laten ontwikkelen zonder te vertrouwen op een extern representatiemodel. Het gebruik van verschillende ruisniveaus over tokens stimuleert het netwerk om ontbrekende informatie af te leiden en relaties tussen multimodale observaties te leren.

Is FLUX 3 een wereldmodel?

Black Forest Labs positioneert FLUX 3 als een reality-modelbasis omdat de gedeelde representaties zich uitstrekken van audiovisuele voorspelling naar fysieke actievoorspelling. Het een volledig algemeen wereldmodel noemen gaat verder dan het huidige bewijsmateriaal ondersteunt; een preciezere beschrijving is een multimodaal generatief foundationmodel dat expliciet is ontworpen rond wereldmodeldoelstellingen.

Conclusie

FLUX 3 vertegenwoordigt voor Black Forest Labs een grotere verandering dan een conventionele upgrade van het ene FLUX-beeldmodel naar het andere. Het kernidee is een gedeelde multimodale representatie van de wereld te trainen en die representatie vervolgens te gebruiken voor video, geluid, beelden en uiteindelijk acties. Self-Flow vormt de onderzoeksbasis, terwijl het vrijgegeven FLUX 3 Video-model de eerste productie-demonstratie van die strategie is.

Per september 2026 ondersteunt FLUX 3 Video clips tot 20 seconden, 24 fps, output van HD tot en met UHD/4K, gesynchroniseerde audio, meertalige dialoog, afbeelding-naar-video, keyframes, videovoorzetting, generatie met meerdere shots en Draft Mode.

Het benchmarkbeeld is ook geloofwaardiger dan bij de lancering. BFL’s huidige evaluatie van het vrijgegeven model plaatst FLUX 3 bovenaan in de interne T2V ELO-test, terwijl onafhankelijke Megaton-tests het derde rangschikken en een bijzonder sterke scèneconsistentie benadrukken.

FLUX 3 is dus niet automatisch het beste videomodel voor elke werklast. Seedance 2.5, MiniMax H3, en Wan 3.0 kunnen langere generaties, hogere nominale resolutie, lagere prijzen of andere referentie- en bewerkingsmogelijkheden bieden.

Wat FLUX 3 ongewoon interessant maakt, is de richting onder de videogenerator: BFL gokt erop dat dezelfde representaties die nodig zijn om overtuigende video te voorspellen uiteindelijk beeldgeneratie, audio, fysiek redeneren en robotacties kunnen ondersteunen. Ontwikkelaars kunnen de eerste productiestap al testen via FLUX 3 op CometAPI met de model-ID flux-3.

Verder leren

Koppel dit artikel aan de volgende beslissing.

Alle onderwerpen bekijken
Gepubliceerd op Oct 3, 2026
Laatst bijgewerkt Oct 3, 2026
0 weergaven
Gecontroleerd op duidelijkheid, bronvermelding en actuele API-terminologie.

Lees Meer