De fleste AI-videoprompts leses fortsatt som én sammenhengende kamerabevegelse: «cinematic drone over a forest, epic, 8k.» FLUX 3 er offentlig posisjonert for noe skarpere — flere klipp fra én prompt, klipp på opptil omtrent 20 sekunder, og innebygd lyd som følger bildet (Black Forest Labs-lansering; BFL-blogg; tidlige multi-shot-notater fra Justine Moore; varighet/lyd-dekning i The Decoder).
Dette er en veiledning, ikke enda et lanseringssammendrag. For lanseringskartet, les Hva er FLUX 3?. Her lærer du å skrive prompts med flere klipp, når du skal starte fra et stillbilde, hvordan du styrer lyd, og hvordan du godkjenner eller underkjenner et opptak inne i FLUX 3-videogeneratoren på flux3.video.
TLDR
- Åpne FLUX 3-video.
- Skriv Shot 1 / Shot 2 / Shot 3 (hvem, kamera, handling) i stedet for én vag stemning.
- Begrens ambisjonen: for første utkast, sikte på ca. 8–12 s klarhet før du maksar lengden.
- Legg til lydhensikt (atmosfære / lydeffekter / ingen musikk) i én linje.
- Vurdering i fullskjerm: ansikter, klipplogikk, hender, leppebevegelse hvis noen snakker, utsnitt for Reels.
- Valgfritt: lås et hero-stillbilde på bilde, deretter bilde til video.
Hovedpunkter
- Flere klipp er en kjernefunksjon: skapere med tidlig tilgang framhever flere vinkler i én generering (venturetwins).
- Ca. 20 s er den offentlige takfortellingen — ikke et krav for hvert opptak (The Decoder).
- Innebygd lyd betyr at du kan spesifisere atmosfære/lydeffekter/dialogenergi i stedet for alltid å synke i etterkant (BFL-lansering; The Decoder).
- Promptstruktur slår adjektiv: nummerer klippene, navngi kameraet, frys antrekkskontinuitet.
- Hovedsiden: alt under kjører på videogeneratoren (tekst til video og bilde til video).
Før du starter (sjekkliste på 60 sekunder)
| Sjekk | Hvorfor | | --- | --- | | Du har en ekte jobb (UGC-annonse, produktspinn, dialogbeat) | Tilfeldige «episke» prompts sløser gratis kjøringer | | Du kan liste 2–4 klipp på papir | Modeller for flere klipp belønner eksplisitte kutt | | Antrekk / motiv er én tydelig linje | Identitetsglidning starter ofte med vage karakterer | | Du kjenner sideforhold (9:16, 16:9, 1:1) | Sosiale utsnitt dreper gode sentre | | Du ser én gang i fullskjerm | Miniatyrer lyver om ansikter og hender |
Steg 1 — Åpne FLUX 3-videogeneratoren
Gå til FLUX 3-video. Behold FLUX 3 valgt som husets videomodell. Bli på denne siden for både tekst til video og bilde til video — du trenger ikke et annet produkt for den grunnleggende løkken.
Trenger du stillbilder først? Generer eller finjuster et hero-bilde på FLUX 3-bilde, last ned/lagre det, og animer deretter på video.
Steg 2 — Skriv prompts med flere klipp (kjerneferdigheten)
Bruk dette skjelettet hver gang:
- Formatlinje — varighetshensikt, sideforhold, sjanger.
- Opptaksliste — Shot 1 wide / Shot 2 medium / Shot 3 close (handlingsverb).
- Kontinuitetslinje — samme folk, samme klær, samme sted.
- Lydlinje — atmosfære, lydeffekter, dialog eller stillhet.
- Negativer — ingen vannmerke, ingen ekstra logoer, ingen tilfeldig tekst.
Prompt 1 — produktunboxing med flere klipp (lim inn)
Vertical 9:16 product ad, about 10 seconds, clean desk daylight.
Shot 1 wide: sealed matte white product box on oak table, soft window light.
Shot 2 medium: hands open the box lid smoothly, tissue paper folds clearly.
Shot 3 close-up: wireless earbuds lift toward camera, subtle specular highlight.
Same hands, same box branding color, continuous desk environment.
Soft paper rustle and light whoosh SFX, no music bed, no on-screen text, no watermark.
Prompt 2 — dialogbeat med flere klipp
Horizontal short scene, about 12 seconds, warm kitchen night.
Shot 1 medium two-shot: two friends at a small table, tea cups, fairy lights bokeh.
Shot 2 over-shoulder: person A speaks with natural lip motion, soft smile.
Shot 3 reaction close-up: person B laughs, eyes crinkle, steam rises from cup.
Same wardrobe and hairstyles across all shots, consistent table props.
Quiet room tone plus light cup clink SFX; dialogue energy, no loud score, no subtitles, no watermark.
Prompt 3 — utendørs action med flere klipp (enkel)
Horizontal action clip, about 8 seconds, golden hour park path.
Shot 1 wide tracking: runner in red jacket jogs toward camera on gravel path.
Shot 2 side medium: arms and jacket fabric motion, trees streak softly.
Shot 3 low angle hero: runner passes, dust motes in sunbeams.
Same red jacket and black shorts throughout.
Footsteps and light wind ambience, no music, no text, no watermark.

Prompt-først bevegelsesspråk · visningsbilde på FLUX 3 · generert-stil stillbilde til planlegging, ikke et gradert filmstill
Steg 3 — Legg til innebygd lyd med vilje
FLUX 3s offentlige historie inkluderer innebygd lyd med video (BFL; The Decoder). Behandle lyd som en regilinje, ikke en ettertanke:
| Hensikt | Eksempellinje | | --- | --- | | Bare atmosfære | “city night ambience and light rain, no music, no dialogue” | | Lydeffekt-treff | “soft whoosh on logo settle, no voiceover” | | Dialogenergi | “natural conversational speech, quiet room tone, no score” | | Stillhet | “no music, no SFX, no dialogue—picture only” |
Leppesynk-tips: plasser det talende ansiktet i et nær- eller mediumbilde og si «natural lip motion» eksplisitt (Prompt 2). Ekstreme helbilder gjør munn detalj vanskeligere å vurdere.
Steg 4 — Tekst til video mot bilde til video
| Start fra | Bruk når | Vei | | --- | --- | --- | | Tekst til video | Du finner opp hele scenen | Videogenerator | | Bilde til video | Du allerede eier et produktfoto, karakterbilde eller plakat | Samme videoside; valgfritt stillbilde fra bilde |
Oppskrift for bilde til video: hold stillbildet enkelt (ett motiv, tydelige kanter), og prompt deretter bare bevegelse + kamera + lyd — ikke beskriv et annet antrekk.
Image-to-video, 6 seconds, gentle push-in.
Preserve the exact product, colors, and logo from the reference still.
Soft studio light consistency, subtle rotation of the product, clean background.
Soft whoosh SFX, no new text, no watermark.
Steg 5 — Godkjent/ikke godkjent-sjekkliste (fullskjerm)
Se én gang uten å skrubbe, deretter skrubb:
- Klipplogikk — leses Shot 1→2→3 som tilsiktet?
- Identitet — samme ansikt, hår, antrekk på tvers av kutt?
- Hender / rekvisitter — ekstra fingre, smeltende esker, skliende etiketter?
- Lydtreff — matcher lyden hendelsene (eller ba du om stillhet)?
- Utsnitt — ansikter og produkt trygge for 9:16?
- Tekstsøppel — tilfeldige glyfer eller vannmerker?
Hvis to av disse feiler, skriv om opptakslisten før du brenner flere kjøringer. Vanligvis er fiksen kortere, tydeligere klipp, ikke flere adjektiv.
Vanlige feilmoduser (og fikser)
| Symptom | Sannsynlig årsak | Fiks | | --- | --- | --- | | Ett langt sammenhengende opptak | Ingen nummererte klipp | Legg til eksplisitte Shot 1/2/3 | | Karakteren morpher mellom kutt | Vagt antrekk | Én setning som låser klær/hår | | Travelt lydbilde | Motstridende musikk + dialog + lydeffekter | Velg én lydprioritet | | Flott ansikt, dårlig produktlogo | For mye kamerakaos | Langsom innkjøring; færre kutt | | God 16:9, ødelagt 9:16 | Ingen sideforhold i prompten | Oppgi vertikal 9:16 + sentrert motiv |
Slik kjører du en 3-stegs vurderingsløkke på FLUX 3
- Åpne FLUX 3-video.
- Lim inn Prompt 1 (eller ditt ekte oppdrag med skjelettet).
- Vurder med godkjent/ikke-listen → lagre det beste → valgfritt poler med bilde til video fra et stillbilde på bilde.
FAQ
Hva gjør FLUX 3-video annerledes å prompte?
Offentlige skapernotater legger vekt på kontroll av flere klipp fra én prompt og sterkere mikrodetalj (venturetwins; BFL-lansering). Skriv kutt, ikke bare stemninger.
Hvor langt bør det første FLUX 3-klippet mitt være?
Offentlig materiale diskuterer genereringer på opptil omtrent 20 sekunder (The Decoder). For å lære flere klipp, start rundt 8–12 sekunder slik at hvert beat forblir lesbart.
Hvor mange klipp bør jeg be om?
To til fire for første utkast. Flere klipp øker kontinuitetsrisikoen før du har en stabil karakterlinje.
Kan FLUX 3 gjøre innebygd lyd og leppesynk?
Innebygd lyd er del av den offisielle multimodale historien (BFL; The Decoder). Community-demoer framhever også leppebevegelse — lytt og zoom alltid dine egne opptak.
Bør jeg bruke tekst til video eller bilde til video?
Tekst til video for oppdiktede scener; bilde til video når merkevarestillbilder allerede finnes. Begge ligger på videogeneratoren.
Trenger jeg bildesiden?
Bare hvis du vil ha et kontrollert stillbilde først. Generer på bilde, og animer deretter på video.
Hvorfor kollapser «flere klipp» til ett sammenhengende opptak?
Prompten mangler trolig nummererte klipp og kamerastørrelser. Bruk skjelettet i steg 2.
Kan jeg forby musikk?
Ja — si «no music bed» eller «picture only, no SFX» i lydlinjen.
Hvor prøver jeg dette gratis?
Åpne FLUX 3-video på flux3.video og start gratis — uten kort for å begynne.
Hva bør jeg lese videre?
Lanseringsoversikten: Hva er FLUX 3?.
Om Reese Okada
Reese Okada er skribent for AI-videoarbeidsflyt som gjør prompts med flere klipp om til gjentakbare nettleserflyter på FLUX 3.
