Elk frontier-videomodel behandelen als “dezelfde tekst-naar-videobox” is hoe teams gratis runs verbranden en toch zachte clips opleveren. FLUX 3 van Black Forest Labs wordt publiek neergezet als een multimodaal systeem—beeld, video, audio en action-prediction onder één architectuur—met nadruk in de launchweek op clips van ~20s, multi-shot uit één prompt en native audio (BFL-blog; officiële launchthread; The Decoder-samenvatting). Peersystemen van Runway, Kling, OpenAI, Google DeepMind, Luma, xAI en ByteDance Seed benadrukken elk andere assen—bewegingstrouw, storyboardsturing, fysica of bewerken met meerdere referenties.
Dit is een criteriagids, geen eeuwige ranglijst. Je gaat weg met een head-to-headtabel van publieke capaciteitsassen, scenario als/dan-regels en drie copy-pasteprompts om te beoordelen op de FLUX 3-videogenerator. Voor de launchkaart begin je met Wat is FLUX 3?; voor multi-shotvakmanschap gebruik je FLUX 3-video: multi-shot, clips van ~20s en native audio.
TLDR
- FLUX 3 (23 juli 2026): multimodale ruggengraat; publiek videoverhaal = multi-shot + ~20s + native audio (BFL-blog; The Decoder).
- Peers zijn geen klonen: Runway Gen-4.5 leunt op bewegingskwaliteit / promptadherentie (Runway-research); Kling VIDEO 3.0 levert multi-shot + native audio in productdocs (Kling VIDEO 3.0-gids); Sora 2 benadrukt fysica + multi-shot + gesynchroniseerd geluid (OpenAI); Veo 3.1 koppelt video aan native audio (DeepMind Veo); Luma Ray3.x legt de nadruk op stuurbaar continuïteit / modify (Luma Ray); Grok Imagine Video focust op beeld naar video + audio + snelheid (xAI); Seedance 2.0 is multimodale audio-video met rijke referenties (ByteDance Seed).
- Beslisregel: kies op de klus (cuts, lipsync, still→motion, fysica, sturing)—niet op één Elo of vendor-voorkeurstabel.
- Op deze site: draai dezelfde prompts op FLUX 3-video (en stills op beeld) en score beste takes zelf.
Key Takeaways
- Multi-shot is in 2026 een eersteklas as—vroege FLUX 3-notities benadrukken multi-angle-reeksen uit één prompt (Justine Moore / a16z); Kling documenteert multi-shotnarratieven (VIDEO 3.0-gids); Sora 2 claimt het volgen van multi-shotinstructies met persistentie van wereldtoestand (OpenAI).
- Native audio is nu de basis, geen extraatje: FLUX 3 (The Decoder), Sora 2 (OpenAI), Veo (DeepMind), Kling (VIDEO 3.0), Grok Imagine Video (xAI), Seedance 2.0 (Seed).
- Vendor-voorkeurstabellen zijn vroege signalen, geen peer-reviewed kronen—BFL-gerelateerde launchverslaggeving bevat voorlopige voorkeurscijfers versus andere systemen; behandel ze alleen als context (The Decoder-grafieksamenvatting).
- Wat je kunt sturen, verschilt: sommige stacks verkopen pure generatiekwaliteit; andere verkopen keyframe-bewerken, video aanpassen, meerdere referenties of app-ecosystemen (bijv. Luma Ray3 Modify; Runway Gen-4.5-positionering).
- FLUX-merkcontinuïteit telt als jouw still-taal al in FLUX leeft—stills op beeld, beweging op video (serielijn via BFL FLUX.2 → FLUX 3).
- Zelfde-promptbeoordeling op één browseroppervlak wint van abstracte ranglijsten voor ads en korte films—start gratis op FLUX 3-video.
Head-to-head: publieke assen (geen ranglijst)
Lees deze tabel in 30 seconden. Cellen zijn publieke positionering / gedocumenteerde functies, geen onafhankelijke labscores. Leeg of “check product” betekent dat de as niet de headline-claim is die we in de gelinkte primaire materialen vonden—niet dat het product niets kan.
| As (jouw klus) | FLUX 3 (BFL) | Runway Gen-4.5 | Kling VIDEO 3.0 | OpenAI Sora 2 | Google Veo 3.x | Luma Ray3.x | Grok Imagine Video | Seedance 2.0 | | --- | --- | --- | --- | --- | --- | --- | --- | --- | | Primaire publieke pitch | Multimodale visuele intelligentie; video + audio + beeldfamilie (BFL) | Bewegingskwaliteit, promptadherentie, visuele trouw (Runway) | Multi-shotnarratieven + native audio + consistentie (Kling) | Fysiek accurate video + gesynchroniseerde dialoog/SFX (OpenAI) | Leading videogen met native audio (DeepMind Veo) | Stuurbaar, doorlopend, cinematische controle (Luma Ray) | Snelle image/video met native audio (xAI) | Multimodale audio-video gezamenlijke gen + rijke refs (Seed) | | Multi-shot / multi-cut | Sterk launchverhaal (venturetwins; The Decoder) | Sturing & compositie benadrukt; niet het enige “multi-shotproductverhaal” (Runway) | Gedocumenteerde multi-shotcreatie (Kling) | Multi-shotinstructies + wereldtoestand (OpenAI) | Cinematische taal / controls; productduren vaak korte clips in Studio (AI Studio Veo) | Elke cut / frame-richting afmaken (Luma Ray) | Beweging vanuit stills & prompts; multi-cut is niet de kernmerklijn (xAI) | Multi-shot-erfgoed in de Seedance-lijn + 2.0 multimodale sturing (Seedance 1.0; 2.0) | | Native / gesynchroniseerde audio | Publieke claim (BFL; The Decoder) | Generatiefocus in de Gen-4.5-researchpost vaak visueel-eerst (Runway) | Native-audio-upgrade in VIDEO 3.0 (Kling) | Dialoog + SFX + soundscapes (OpenAI) | Video ontmoet audio (DeepMind) | FAQ-oppervlak bevat audiovragen op de productpagina (Luma Ray) | Native audio- en spraakverbeteringen (xAI) | Gezamenlijke audio-video-architectuur (Seed) | | Fysica / materiaalrealisme | Alledaags “levensechter” multimodaal kader (BFL; wire) | Gewicht, vloeistoffen, haar, materialen benoemd (Runway; CNBC) | Consistentie + narratieve polish in productcopy (Kling) | Expliciete fysicasprong vs eerdere Sora (OpenAI) | High-fidelity storytellingpitch (DeepMind) | Fysieke logica in modify-workflows (Luma-news) | Betere beweging & fysica in 1.5 (xAI) | Bewegingsstabiliteit + immersieve AV (Seed) | | Still → motion / referenties | Beeldpad in de familie + browser-i2v op deze site (BFL; videotool) | Sterk ecosysteem voor generate + edit-modi (Runway) | Startframe + elementreferentie in de 3.0-matrix (Kling-gids) | Tekst en/of beeld (en remixpaden in ecosysteemdocs) (OpenAI) | Tekst-, beeld- en video-inputs op recente Veo-kaarten (AI Studio) | Keyframe / karakterreferentie-modify (Luma) | Beeld naar video is een vlaggenschippad (xAI) | Tekst-, beeld-, audio- en video-inputs (Seed) | | Duurverhaal (publiek) | Tot ~20s vaak genoemd (The Decoder) | HD-clipgeneratie; check productlimieten voor jouw plan (Runway) | Product-multi-shotduren per shot (Kling-gids) | Stuurbare multi-shotreeksen; productlengte verschilt per oppervlak (OpenAI) | Studiokaarten noemen korte vaste lengtes (bijv. 4/6/8s-banden) (AI Studio) | Workflow-georiënteerde lengtes; bevestig in product-FAQ (Luma) | Korte clipbanden in API-voorbeelden (bijv. samples tot 10s) (xAI API) | Cinematische multi-shotoutput; producttiers variëren (Seed) | | Probeerpad op dit product | FLUX 3-video + beeld | N.v.t. (andere vendor) | N.v.t. | N.v.t. | N.v.t. | N.v.t. | N.v.t. | N.v.t. |
Hoe je de tabel gebruikt: is jouw opdracht “drie cuts, één personage, ambient room tone,” weeg dan de kolommen multi-shot + audio. Is het “vloeistofschenk, gewichtig product,” weeg fysica. Is het “deze exacte verpakkingsstill moet bewegen,” weeg still→motion / referenties.

Criteria, geen kronen · redactioneel coverkader voor deze vergelijking · gegenereerd op FLUX 3
Familielijn (alleen FLUX—daarna peers)
| Generatie | Publiek thema | Anker | | --- | --- | --- | | FLUX.2 | Productiestills & bewerken | BFL FLUX.2-blog | | FLUX 3 | Multimodale video + audio + beeldrugengraat | BFL FLUX 3-blog | | Peerklasse (2025–2026) | Gespecialiseerde videosystemen met concurrerende sturingsverhalen | Runway Gen-4.5 · Kling VIDEO 3.0 · Sora 2 · Veo 3.x · Luma Ray3.x · Grok Imagine Video · Seedance 2.0 (links in de tabel hierboven) |
Peers zijn geen FLUX-familieleden. Neem niet aan dat esthetiek, safetyfilters of duurknoppen identiek zijn alleen omdat ze allemaal een tekstprompt accepteren.
Scenario-winnaars (als / dan)
1. Social UGC-ad met twee cuts en room tone
Als je een wide → close-verhaal in één generatie nodig hebt en het belangrijk vindt dat sfeer aan de scene vastzit, dan geef je voorrang aan modellen waarvan publieke materialen multi-shot + native audio benadrukken (FLUX 3-launchverhaal; Kling VIDEO 3.0-docs; Sora 2 audio+multi-shotclaims).
Op deze site: draft Shot 1 / Shot 2 in één alinea op video voordat je een ander videomodel/tool zoekt.
2. Producthero vanaf een gelockte still
Als verpakking, logocrop en materiaalfinish al als still zijn goedgekeurd, dan start je beeld-naar-video-workflows (of eerst een still)—het publieke verhaal van Grok Imagine Video is sterk i2v (xAI); Seedance 2.0 en Kling 3.0 documenteren referentie-/startframepaden; FLUX 3 kan eerst een still genereren en vastzetten, daarna beeld-naar-video (BFL).
Op deze site: bevries de still op beeld en animeer daarna op video.
3. Fysica-gag of materiaaldemo
Als de grap of het bewijs gewicht, vloeistof, stof of botsingen is, dan weeg je systemen die fysieke nauwkeurigheid marketen (Sora 2; Runway Gen-4.5-researchtaal). Valideer nog steeds met jouw exacte object—marketingdemo’s zijn niet jouw SKU.
Op deze site: gebruik Prompt C hieronder en beoordeel fullscreen handen, randen en contactpunten.
4. Dialoog- / lipsync-explainer
Als een personage on-camera moet spreken, dan geef je voorkeur aan stacks met native audio + spraak in het officiële verhaal (Sora 2; Kling native audio; FLUX 3 dialoog/SFX-narratief; Grok Imagine-spraakverbeteringen). Verwacht retries; lipsync is een slaag/faal-checklist, geen gegarandeerde eerste take.
Op deze site: Prompt B + één keer luisteren met een koptelefoon.
5. Lange sturingslus (modify, extend, board)
Als je team leeft in iteratieve keyframes, modify-video of multi-assetboards, dan vergelijk je naast een eerste generate-en-beoordelen-ronde ook modellen die duidelijk keyframe-bewerken, video aanpassen en multi-asset-referenties ondersteunen (Luma Ray3 Modify; Seedance multimodale referenties; Google Veo).
Op deze site: de eerste generate-en-beoordelen-ronde is de CTA—haal een beste clip op video en breng winnaars daarna naar je editstack.
Wat we weten vs. wat we niet weten
| We weten (bronvermeld) | We weten niet / claimen we niet | | --- | --- | | Publieke FLUX 3-launch 23 juli 2026, multimodale positionering (@bfl_ai; BFL-blog) | Een permanente wereldwijde #1-videomodel over elke klus en stijl | | Multi-shot + ~20s + native audio verschijnen in launchverslaggeving voor FLUX 3 (The Decoder; venturetwins) | Dat elke host identieke duur-/resolutieknoppen toont | | Peervendors publiceren verschillende headlines (fysica, multi-shotproductmatrices, modify-workflows, multimodale refs)—zie tabellinks | Onafhankelijke, peer-reviewed cross-lab-ranglijsten die alle assen beslechten | | Vroege voorkeurscijfers in launchverslaggeving zijn voorlopig / vendorcontext (The Decoder) | Dollar-per-seconde-prijstabellen over kanalen heen (hier niet vergeleken) | | Dit product biedt browser-FLUX 3-video en beeld | Dat één enkele gratis run productieparaatheid voor elke brand-safetylat bewijst |
Hoe je op FLUX 3 beoordeelt (zelfde-promptprotocol)
- Open FLUX 3-video.
- Draai Prompt A, B en C hieronder ongewijzigd (of wijzig alleen productnamen / kledingcontinuïteitszinnen die je écht nodig hebt).
- Score elke take op vijf dimensies (elk 0–2): cut-helderheid, onderwerpidentiteit, bewegingsrealisme, audiopas, of het 9:16-kader het onderwerp niet afsnijdt.
- Bewaar elke clip ≥7/10 als kandidaat; herschrijf alleen de falende shotregel.
- Optioneel: lock een still op beeld en doe beeld naar video van dezelfde opdracht.
Prompt A — multi-shot social UGC
Vertical 9:16 UGC ad, about 10 seconds, daylight kitchen.
Shot 1 wide: young adult in a blue hoodie pours iced coffee into a clear glass, casual phone-tripod energy.
Shot 2 medium: glass fills, ice clinks, condensation visible, same hoodie and kitchen tiles.
Shot 3 close-up: satisfied sip, natural smile, soft window light, no logos.
Natural kitchen ambience and ice clink SFX, no music bed, no captions, no watermark.
Prompt B — dialoog-explainerbeat
Horizontal 16:9 product explainer, about 8 seconds, clean home office.
Medium shot: friendly presenter in a charcoal sweater speaks to camera,
holds a small white wireless earbud case, clear enunciation, natural hand gestures.
Background: blurred bookshelf, soft daylight.
Native dialogue energy: short line about "all-day battery," ambient room tone only, no music, no on-screen text, no watermark.
Prompt C — productfysica / materiaal
Product commercial, 8 seconds, studio softbox, 16:9.
Macro to medium: matte black aluminum water bottle on slate table.
Slow push-in as a bead of water rolls down the side, realistic weight and reflection,
then a hand lifts the bottle smoothly—fingers and metal contact stay solid.
Subtle studio ambience only, no music, no logos beyond the bottle, no watermark.

Prompt-first bewegingstaal · showcase-keyframe op FLUX 3 · gebruik met Prompt A–C hierboven

Alledaagse tot cinematische still-taal · showcase-stijlkader op FLUX 3 · combineer met Prompt C
Beslisregel (één zin)
Kies FLUX 3 eerst wanneer je een browser-native multi-shot + audioprobeerpad in de multimodale FLUX-familie wilt en zelf beste takes beoordeelt op echte prompts—niet wanneer een vendortabel of social thread een permanente winnaar kroont.
Gebruik een ander model als je vooral wilt nabewerken wanneer je knelpunt modify-video, multi-assetreferentieborden of een gespecialiseerde app-workflow is die die vendors als kernproduct documenteren—nadat je al weet dat jouw prompt faalt op de assen hierboven.
FAQ
Is FLUX 3 “beter” dan Sora, Runway of Kling?
Niet als universele rang. Publieke materialen tonen overlappende maar verschillende sterktes (zie tabel). Beter = past bij jouw klus na zelfde-prompttests—niet één Elo of vroege voorkeurstabel (The Decoder-context).
Wat is de eerlijkste manier om AI-videomodellen te vergelijken?
Lock prompt, beeldverhouding en beoordelingschecklist, verander alleen model/host, en score cuts, identiteit, fysica, audio, crop. Dat is het protocol hierboven op FLUX 3-video.
Doet FLUX 3 multi-shot uit één prompt?
Maker- en persnotities in de launchweek behandelen multi-shot als headline-capaciteit (venturetwins; The Decoder). Schrijf Shot 1 / Shot 2 / Shot 3 expliciet—zie de multi-shotgids.
Claimen peermodellen ook native audio?
Ja—voorbeelden zijn Sora 2 (OpenAI), Veo (DeepMind), Kling VIDEO 3.0 (gids), Grok Imagine Video (xAI) en Seedance 2.0 (Seed). Audiokwaliteit heeft nog steeds elke keer een luisterpass nodig.
Wanneer moet ik vanaf een still starten in plaats van pure tekst?
Wanneer brandverpakking, gezichtsgelijkenis of layout al is goedgekeurd. Genereer/verfijn stills op FLUX 3 Image en animeer daarna op video.
Hoe lang kunnen FLUX 3-clips zijn?
Publieke coverage noemt vaak ongeveer 20 seconden als narratief plafond (The Decoder). Voor eerste drafts krijgen veel makers duidelijkere resultaten rond ~8–12s voordat ze de lengte maximaliseren.
Moet ik Artificial Analysis / Elo / vendor-voorkeurstabellen vertrouwen?
Als context, ja; als aankoop-evangelie, nee. Publieke Gen-4.5-research citeert leaderboard-Elo (Runway); FLUX-launchverslaggeving bevat voorlopige voorkeursachtige cijfers (The Decoder). Jouw SKU en crop beslissen nog steeds de beste takes.
Is deze site officieel van Black Forest Labs?
Nee. flux3.video is een onafhankelijk product dat FLUX 3-branded browsergeneratie biedt. Officieel modelonderzoek leeft op bfl.ai en BFL-kanalen.
Kan ik FLUX 3 proberen zonder lokale tools te installeren?
Ja—open FLUX 3-video of beeld in de browser.
Wat als handen of gezichten de checklist niet halen?
Regenereer één keer met een strakkere medium/close shot en bevroren kledingtaal; stapel geen extra bijvoeglijke naamwoorden. Drijft de identiteit nog, zet dan eerst een still vast en doe daarna beeld naar video.
Waar leer ik het multi-shotpromptformaat?
Lees FLUX 3-video: multi-shot, clips van ~20s en native audio en plak Prompt A hierboven in de generator.
Over Avery Lin
Avery Lin is analist van FLUX-modelreleases. Avery volgt launches in de FLUX-familie en zet publieke modelfeiten om in duidelijke probeerpaden op FLUX 3—eerst criteria, dan hype.
