Het eerste videomodel van Black Forest Labs: clips van 20 seconden met gesynchroniseerde audio, tot 10 vastgepinde keyframes en looks die variëren van live-action tot stop-motion. Typ hieronder een prompt en probeer het.
Ontwikkelaar
Black Forest Labs
Type
Multimodaal (video nu, afbeelding binnenkort)
Audio
Native, gesynchroniseerd, hetzelfde wachtwoord
Duur
Tot 20 s per passage
Sleutelframes
Tot 10 vastgezet + eerste/laatste
Gewichten openen
Ontwikkeling gepland, eind 2026
Niveau hier
Betaalde credits + conceptmodus
Ons oordeel in één regel: de storyboard-keuze. Wanneer je precies weet welke frames de shot moet raken — of je een look wilt die niet op “cinematic AI video” lijkt — begin dan hier.
FLUX 3 komt uit het Freiburg-lab waarvan de oprichters de architectuur achter Stable Diffusion hebben gebouwd, en het is hun eerste model dat beweegt: één netwerk dat gezamenlijk is getraind op afbeeldingen, video, audio en actie, met video als eerste levering. Twee dingen laten het opvallen in een drukke maand — je kunt tot tien exacte frames vastzetten en het model ertussen laten animeren, en de output zit niet vast aan de glanzende “AI cinematic”-look. Rauw, nostalgisch, handgemaakt, vreemd: het bereik is het punt.
Eerste indrukken van onze testrenders plus het door BFL gepubliceerde materiaal — met hun eigen voorbehouden ongewijzigd doorgegeven. We herzien dit zodra onafhankelijke cijfers binnenkomen.
• Keyframebeheer.
Pin tot 10 exacte frames plus de eerste en laatste vast, en het model genereert daartussen beweging, camera, dialoog en audio. Storyboarding als invoerformaat — niets anders dat we hosten accepteert zoveel ankers.
• Esthetisch bereik.
Stop-motion, macro, time-lapse, nostalgische homevideo, opzettelijk vreemd — het ontsnapt aan de uniforme filmische glans waar de meeste videomodellen standaard op terugvallen. Als de uitstraling van je merk geen "filmtrailer" is, doet dit ertoe.
• Audio in dezelfde pass.
Tot 20 seconden met een gesynchroniseerde soundtrack — inclusief dialoog — en naadbewuste verlenging die beweging, camera en audio over de overgang heen meeneemt wanneer je een clip verlengt.
• Economie van de conceptmodus.
Elk eindpunt heeft een snelle conceptvariant voor goedkope previews. Itereer op het concept, besteed echte credits slechts één keer aan de definitieve versie — de workflow die deze hele site predikt, ingebouwd in de modelfamilie.
• Het afbeeldingsgedeelte is er nog niet.
De naam FLUX is beroemd om afbeeldingen, maar de afbeeldingsgeneratie van FLUX 3 wordt nog steeds uitgerold. Als je hier bent gekomen om plaatjes te maken, duurt dat nog weken — bekijk de FAQ voordat je credits verbrandt om daarachter te komen.
• Benchmarks zijn huisnummers.
De lanceringsgrafiek werd aangeduid als een voorlopige evaluatie van een vroege kandidaat, en de meest opvallende winstpercentages kwamen tegen modellen die momenteel niet de toon zetten. BFL's latere claims zijn sterker, maar nog steeds intern.
• 20 seconden, niet 30.
Wan 3.0 en Seedance 2.5 halen allebei 30 in één run. FLUX 3 antwoordt met een uitbreiding die de naad respecteert — maar als de briefing om één ononderbroken halve minuut vraagt, is het niet de juiste keuze.
• Ontwikkelingswegingen: gepland, niet gedateerd.
De open-weight-release is aangekondigd voor later in 2026, zonder datum of licentievoorwaarden. BFL's staat van dienst op het gebied van open source is echt goed, maar een plan blijft een plan.
Eén voor het uiterlijk, één voor de keyframes, één voor de naad. Kopieer, verwissel de haakjes, render — eerst in conceptmodus.
"Een handgemaakte stop-motion-scène: een [astronaut] van klei plant een piepklein papieren vlaggetje op een keukentafelmaan gemaakt van bloem. Zichtbare vingerafdrukken in de klei, licht schokkerige 12fps-beweging, zacht raamlicht, geluiden van vilten voetstappen en een gedempte dialoogregel met een piepende stem."
Het benoemen van de imperfecties — vingerafdrukken, schokkerige framesnelheid — is wat FLUX 3 wegstuurt van de standaardglans. De meeste modellen werken “handgemaakt” tegen; dit model behandelt het als een stijldoel.
Uploaden: 4 keyframes (product in doos → uitgepakt → in de hand → logokaart)
"Een unboxing van 20 seconden die deze vier frames op volgorde laat zien, met ongeveer 5 seconden ertussen. Natuurlijk handheld-gevoel, geluiden van scheurend papier en tape, stille vreugde van een stem buiten beeld bij frame drie."
De frames dragen de compositie, dus de prompt hoeft alleen timing, beweging en geluid aan te sturen. Aanwijzingen voor tussenruimte ("ongeveer 5 seconden uit elkaar") voorkomen dat het model de beats afraffelt. Dit is de workflow waar storyboard-first teams op hebben gewacht.
Beginnen vanaf: een clip die je al hebt gegenereerd
"Verleng met 10 seconden: [dancer] voltooit de draai waarop de clip eindigt, de camera blijft met dezelfde snelheid naar links driften, de muziek gaat zonder hapering door — geen knip, geen reset."
De extensie leest de beweging en audio van de laatste frames, dus de instructie moet een voortzetting beschrijven, geen nieuwe scène. "Voltooit de draai waarop de clip eindigt" geeft het de fysieke draad om aan te trekken; het noemen van de camerasnelheid beschermt de drift over de naad.
Drie audio-native modellen, drie besturingsfilosofieën. Dezelfde prompts in alle drie, beoordeeld op wat we zouden uitbrengen — voorlopig voor de twee nieuwere. Vergelijk ze zelf vanuit één promptvak.
aangekondigd op 23 juli: één architectuur voor beeld, video, audio en actie. Video werd als eerste uitgebracht (20 s, native audio, keyframes); beeldgeneratie wordt in de daaropvolgende weken uitgerold; de open-weight Dev-release staat gepland voor later dit jaar. De versie op deze pagina.
het beeldtijdperk dat de naam bekend maakte: FLUX.1 dev werd een van de meest gedownloade en gefinetunede open diffusie-releases waar dan ook, de ruggengraat van talloze community-workflows.
het oprichtingsteam bouwde de latente-diffusiearchitectuur achter Stable Diffusion. De open-sourcegeloofwaardigheid die die geschiedenis oplevert, is waarom "FLUX 3 Dev" als belofte meer gewicht heeft dan de meeste toezeggingen rond open gewichten.
Het eerste multimodale foundation model van Black Forest Labs, aangekondigd op 23 juli 2026 — één architectuur die gezamenlijk is getraind op afbeeldingen, video, audio en actievoorspelling, van het team uit Freiburg waarvan de oprichters de architectuur achter Stable Diffusion hebben gebouwd. Het onderdeel waarmee je vandaag kunt genereren is video: tot 20 seconden met een gesynchroniseerde soundtrack in dezelfde run, vanuit tekst, een startafbeelding, vastgezette keyframes of een bestaande clip die je wilt verlengen.
De realist. Wanneer de clip moet doorgaan voor echte beelden, met audio.
De long take. Shots van 30 seconden, gemonteerd op je soundtrack.
De documentlezer. Presentaties, pdf’s en spreadsheets erin, video eruit.