De fleste AI-videoprompts lyder stadig som ét kontinuerligt kameratræk: »cinematic drone over a forest, epic, 8k.« FLUX 3 er offentligt positioneret til noget skarpere—flere klip fra ét prompt, klip på op til omkring 20 sekunder og native lyd, der følger billedet (Black Forest Labs-lancering; BFL-blog; tidlige multi-shot-noter fra Justine Moore; varigheds-/lydrapportering i The Decoder).
Dette er et how-to, ikke endnu et lanceringsrecap. Til lanceringskortet, læs Hvad er FLUX 3?. Her lærer du at skrive multi-shot-prompts, hvornår du starter fra et still, hvordan du angiver lyd, og hvordan du godkender eller kasserer et take i FLUX 3-videogeneratoren på flux3.video.
Kort sagt
- Åbn FLUX 3-video.
- Skriv Shot 1 / Shot 2 / Shot 3 (hvem, kamera, handling) i stedet for én vag vibe.
- Begræns ambitionen: til første udkast sigt efter ca. 8–12 s klarhed, før du maxer længden.
- Tilføj lydintention (atmosfære / SFX / ingen musik) i én linje.
- Fuldskærmsreview: ansigter, klip-logik, hænder, læbebevægelse hvis der tales, beskæring til Reels.
- Valgfrit: lås et hero-still på billede, derefter billede til video.
Det vigtigste
- Multi-shot er en førsteklasses færdighed: creators med early access fremhæver flere vinkler i én generation (venturetwins).
- Ca. 20 s er den øvre længde, der nævnes offentligt—ikke et krav til hvert take (The Decoder).
- Native lyd betyder, at du kan specificere atmosfære/SFX/dialogenergi i stedet for altid at synce bagefter (BFL-lancering; The Decoder).
- Promptstruktur slår adjektiver: nummerér shots, navngiv kameraet, frys garderobekontinuitet.
- Generatorside: alt nedenfor kører på videogeneratoren (tekst-til-video og billede-til-video).
Før du starter (60-sekunders tjekliste)
| Tjek | Hvorfor | | --- | --- | | Du har et rigtigt job (UGC-annonce, produktspin, dialogbeat) | Tilfældige »episke« prompts spilder gratis runs | | Du kan liste 2–4 shots på papir | Multi-shot-modeller belønner eksplicitte klip | | Garderobe / motiv er én klar linje | Identitetsdrift starter ofte med vage karakterer | | Du kender billedformat (9:16, 16:9, 1:1) | Sociale beskæringer slår gode centre ihjel | | Du reviewer i fuld skærm én gang | Thumbnails lyver om ansigter og hænder |
Trin 1 — Åbn FLUX 3-videogeneratoren
Gå til FLUX 3-video. Behold FLUX 3 valgt som husets videomodel. Bliv på denne side til både tekst til video og billede til video—du behøver ikke et andet produkt til det grundlæggende loop.
Har du brug for stills først? Generér eller finjustér et hero-still på FLUX 3-billede, download/gem det, og animér derefter på video.
Trin 2 — Skriv multi-shot-prompts (kernefærdigheden)
Brug dette skelet hver gang:
- Formatlinje — varighedsintention, format, genre.
- Skudliste — Shot 1 wide / Shot 2 medium / Shot 3 close (handlingsverber).
- Kontinuitetslinje — samme mennesker, samme tøj, samme sted.
- Lydlinje — atmosfære, SFX, dialog eller stilhed.
- Negativer — intet vandmærke, ingen ekstra logoer, ingen tilfældig tekst.
Prompt 1 — multi-shot produktunbox (copy-paste)
Vertical 9:16 product ad, about 10 seconds, clean desk daylight.
Shot 1 wide: sealed matte white product box on oak table, soft window light.
Shot 2 medium: hands open the box lid smoothly, tissue paper folds clearly.
Shot 3 close-up: wireless earbuds lift toward camera, subtle specular highlight.
Same hands, same box branding color, continuous desk environment.
Soft paper rustle and light whoosh SFX, no music bed, no on-screen text, no watermark.
Prompt 2 — multi-shot dialogbeat
Horizontal short scene, about 12 seconds, warm kitchen night.
Shot 1 medium two-shot: two friends at a small table, tea cups, fairy lights bokeh.
Shot 2 over-shoulder: person A speaks with natural lip motion, soft smile.
Shot 3 reaction close-up: person B laughs, eyes crinkle, steam rises from cup.
Same wardrobe and hairstyles across all shots, consistent table props.
Quiet room tone plus light cup clink SFX; dialogue energy, no loud score, no subtitles, no watermark.
Prompt 3 — multi-shot udendørs action (simpelt)
Horizontal action clip, about 8 seconds, golden hour park path.
Shot 1 wide tracking: runner in red jacket jogs toward camera on gravel path.
Shot 2 side medium: arms and jacket fabric motion, trees streak softly.
Shot 3 low angle hero: runner passes, dust motes in sunbeams.
Same red jacket and black shorts throughout.
Footsteps and light wind ambience, no music, no text, no watermark.

Prompt-først bevægelsessprog · showcase-keyframe på FLUX 3 · genereret-stil still til planlægning, ikke et graderet filmstill
Trin 3 — Tilføj native lyd med vilje
FLUX 3’s offentlige fortælling inkluderer native lyd med video (BFL; The Decoder). Behandl lyd som en instruktionslinje, ikke en eftertanke:
| Intention | Eksempellinje | | --- | --- | | Kun atmosfære | “city night ambience and light rain, no music, no dialogue” | | SFX-hit | “soft whoosh on logo settle, no voiceover” | | Dialogenergi | “natural conversational speech, quiet room tone, no score” | | Stilhed | “no music, no SFX, no dialogue—picture only” |
Lipsync-tip: sæt det talende ansigt i et close eller medium-shot, og sig eksplicit »natural lip motion« (Prompt 2). Ekstreme wide shots med fuld krop gør munddetaljer sværere at vurdere.
Trin 4 — Tekst til video vs. billede til video
| Start fra | Brug når | Sti | | --- | --- | --- | | Tekst til video | Du opfinder hele scenen | Videogenerator | | Billede til video | Du allerede ejer et produktfoto, karakterstill eller plakat | Samme videoside; valgfrit still fra billede |
Billede-til-video-opskrift: hold stillbilledet enkelt (ét motiv, klare kanter), og prompt derefter kun bevægelse + kamera + lyd—beskriv ikke et andet outfit.
Image-to-video, 6 seconds, gentle push-in.
Preserve the exact product, colors, and logo from the reference still.
Soft studio light consistency, subtle rotation of the product, clean background.
Soft whoosh SFX, no new text, no watermark.
Trin 5 — Godkend/kassér-tjekliste (fuld skærm)
Se én gang uden at scrube, derefter scrub:
- Klip-logik — læses Shot 1→2→3 som bevidst?
- Identitet — samme ansigt, hår, garderobe på tværs af klip?
- Hænder / props — ekstra fingre, smeltende æsker, glidende labels?
- Lydpasning — matcher lyden begivenhederne (eller bad du om stilhed)?
- Beskæring — er ansigter og produkt sikre til 9:16?
- Tekstforurening — tilfældige glyffer eller vandmærker?
Hvis to af disse falder igennem, omskriv skudlisten, før du brænder flere runs. Som regel er fixet kortere, klarere shots, ikke flere adjektiver.
Almindelige fejlmodes (og fixes)
| Symptom | Sandsynlig årsag | Fix | | --- | --- | --- | | Ét langt kontinuerligt shot | Ingen nummererede shots | Tilføj eksplicit Shot 1/2/3 | | Karakteren morpher mellem klip | Vag garderobe | Én sætning, der låser tøj/hår | | Travl lyd | Modstridende musik + dialog + SFX | Vælg én lydprioritet | | Godt ansigt, dårligt produktlogo | For meget kamerakaos | Langsom push-in; færre klip | | God 16:9, knækket 9:16 | Intet format i promptet | Angiv vertikal 9:16 + centrér motivet |
Sådan kører du et 3-trins vurderingsloop på FLUX 3
- Åbn FLUX 3-video.
- Indsæt Prompt 1 (eller din rigtige opgave med skelettet).
- Vurdér med godkend/kassér-listen → gem den take, du vil beholde → valgfri billede-til-video-polish fra et still på billede.
FAQ
Hvad gør FLUX 3-video anderledes at prompt’e?
Offentlige creator-noter understreger multi-shot-kontrol fra ét prompt og stærkere mikrodetaljer (venturetwins; BFL-lancering). Skriv klip, ikke kun stemninger.
Hvor langt skal mit første FLUX 3-klip være?
Offentlige materialer diskuterer generationer på op til omkring 20 sekunder (The Decoder). Når du lærer multi-shot, start omkring 8–12 sekunder, så hvert beat forbliver læsbart.
Hvor mange shots skal jeg bede om?
To til fire til første udkast. Flere shots øger kontinuitetsrisikoen, før du har en stabil karakterlinje.
Kan FLUX 3 lave native lyd og lipsync?
Native lyd er del af den officielle multimodale fortælling (BFL; The Decoder). Community-demos fremhæver også læbebevægelse—lyt og zoom altid dine egne takes.
Skal jeg bruge tekst til video eller billede til video?
Tekst til video til opfundne scener; billede til video, når brandstills allerede findes. Begge ligger på videogeneratoren.
Har jeg brug for billedsiden?
Kun hvis du vil have et kontrolleret still først. Generér på billede, og animér derefter på video.
Hvorfor kollapser mit multi-shot til ét kontinuerligt take?
Dit prompt mangler sandsynligvis nummererede shots og kamerastørrelser. Brug skelettet i trin 2.
Kan jeg forbyde musik?
Ja—sig »no music bed« eller »picture only, no SFX« i lydlinjen.
Hvor prøver jeg det her gratis?
Åbn FLUX 3-video på flux3.video, og start gratis—intet kort kræves for at begynde.
Hvad skal jeg læse herefter?
Lancerings-oversigten: Hvad er FLUX 3?.
Om Reese Okada
Reese Okada er AI-videoworkflow-skribent, der omsætter multi-shot-prompts til gentagelige browserworkflows på FLUX 3.
