Black Forest Labs positionerer FLUX 3 som ét multimodalt system, der kan generere video + native lyd fra ren tekst eller fra billedreferencer—inklusive animation fra et startframe (BFL FLUX 3-blog, 23. juli 2026; BFL-modelside; lanceringsnoter via @bfl_ai).
På FLUX 3 (dette produkt) ligger begge stier i samme videogenerator. Den dyre fejl er ikke »at vælge den svagere model«—det er at starte den forkerte vej til jobbet: at opfinde emballage, der skal matche juridisk artwork, eller at stramme en scene for hårdt, der kun havde brug for en skrevet shot-liste.
Dette er et beslutnings-how-to: hvornår du starter fra tekst, hvornår du låser et still først, og hvordan du kører et fair vurderingsloop gratis på flux3.video. Til multi-shot-grammatik, brug følgesguiden multi-shot og native lyd. Til lanceringskortet, se Hvad er FLUX 3?.
Kort sagt
| Start med | Bedst når | Spring over når | | --- | --- | --- | | Tekst til video | Du opfinder verden, tester multi-shot-grammatik eller udforsker stilarter | Brandet har brug for eksakt logo-/emballagegeometri | | Billede til video | Du allerede ejer et produktstill, karakterboard eller godkendt frame | Du har intet still og ingen tid til at lave ét—skriv bare tekst | | Hybrid (still → bevægelse) | Identitet eller emballage skal overleve klip | Du kun har brug for en stemningstest |
Standardregel: hvis looket skal matche et godkendt still, brug billede til video. Hvis historie og kamera opfinder looket, brug tekst til video. Begge kører på FLUX 3-video; lav stills på FLUX 3-billede efter behov.
Det vigtigste
- Officiel dobbeltsti: FLUX 3-video inkluderer tekst-til-video og billede-til-video (startframe-animation eller billeder som visuelle referencer), med native lyd på outputs (BFL-blog).
- Ca. 20 s som øvre grænse for én generation er den offentlige længdefortælling—ikke et krav til hvert udkast (The Decoder-opsummering af BFL-materialer; BFL-blog).
- Multi-shot fra ét prompt er en førsteklasses creator-færdighed i tidlige noter—nummerér dine shots på begge stier (Justine Moore / a16z).
- Billede-til-video-promptskift: beskriv bevægelse + kamera + lyd, ikke et andet outfit eller en ny produktform (BFL: startframe-»animation«-ramme).
- Generatorsider her: video til begge tilstande; valgfri still-håndværk på billede.
Head-to-head: tekst vs. still-start
Læs denne tabel først—cirka 30 sekunder til at vælge en sti.
| Dimension | Tekst til video | Billede til video | | --- | --- | --- | | Hvad du giver | Kun skrevet scene | Still + bevægelsesprompt | | Hvad modellen opfinder | Look, garderobe, set, lys | Bevægelse, kamera, tid, ofte lydenergi | | Bedste jobs | Storybeats, UGC-personas, stiludforskning, multi-shot-eksperimenter | Produktspin, brand-packshots, godkendt karakterlås, plakat-til-bevægelse | | Kontinuitetsstyrke | Kommer fra prompt-låse (garderobe-/stedlinjer) | Kommer først fra stillbilledets pixels | | Fejlmode | Logo, ansigt eller produkt skrider, fordi modellen opfinder dem | Still for travlt; promptet beskriver et andet objekt | | Forberedelsestid | Hurtigst | Kræver et rent still (foto eller billedgenerator) | | Officiel kildeliste | BFL FLUX 3-videoliste | Samme post: startframe-animation + billedreferencer |

Prompt-først bevægelsessprog · showcase-keyframe på FLUX 3 · planlægningsstill, ikke et graderet master
Når ren tekst til video vinder
Vælg tekst til video, når stillbilledet endnu ikke findes—eller når det at opfinde stillbilledet ville spilde hele pointen med eksperimentet.
1. Multi-shot-historietests
Du går mere op i læsbarheden Shot 1 → Shot 2 → Shot 3 end i pixelperfekt emballage. Offentlige early access-kommentarer fremhæver multi-shot-kontrol fra ét prompt (venturetwins). Start på video med nummererede shots (fulde opskrifter i multi-shot-how-to).
2. UGC / persona-opfindelse
Intet godkendt talentfoto. Du vil have en troværdig handheld creator, ikke et brandkit-match. Skriv garderobe + rum + taleenergi i én blok—og iterér linjer, ikke stills.
3. Stilrækkeudforskning
BFL fremhæver bred stilrække—fra candid camcorder-energi til animation og filmisk sprog (BFL-blog). Tekst er hurtigere til »prøv tre looks« end at låse tre masters først.
4. Rene konceptpitchs
Stakeholders har kun brug for et første motion-board. Tekst får dig derhen uden art-direction-loop på stills.
Spring ren tekst over når: jura, brand eller ecommerce har brug for eksakt label-art, SKU-farve eller en karakter, der allerede er godkendt som et frame.
Når billede til video vinder
Vælg billede til video, når looket allerede er besluttet, og bevægelse er det, der mangler.
1. Rigtigt produkt / emballage
Hvis æsken, flasken eller UI-screenshotet allerede findes, så opfind det ikke forfra. Pin stillbilledet, og prompt kun rotation, hænder, lys, SFX. Se også produktdemo-promptpakken.
2. Karakteridentitetslås
Godkendt hero-still (eller et still, du genererede på billede) → animér med kontinuitet. BFL’s egen ramme inkluderer at fortsætte fra et startframe som animation (BFL-blog).
3. Plakat / key art til bevægelse
Kampagne-art er fast; du har brug for 6–12 s social push-in. Billede-til-video bevarer kompositionen; tekst-til-video risikerer et »lignende, men ikke det samme«-keyframe.
4. Efter tekst allerede har fundet et vinderstill
Hybridsti nedenfor: frys det bedste frame (eller regenerér et rent still), og kør derefter bevægelse fra den lås.
Spring billede-til-video over når: stillbilledet er rodede, lav-res eller har flere konkurrerende motiver—rens stillbilledet først.

Still-først låsesprog · showcase-frame på FLUX 3 · planlægningsstill, ikke et graderet filmstill
Hybridsti: billedside → videoside
Dette er produktionsloopet, de fleste brandteams faktisk har brug for:
- Lav eller finjustér et still på FLUX 3-billede (eller brug et rigtigt foto).
- Åbn FLUX 3-video → billede til video.
- Prompt kun bevægelse + kamera + lyd + »bevar præcis farver, logo og outfit.«
- Fuldskærmsreview én gang; hvis logoet falder igennem to gange, så stop med at opfinde—fix stillbilledet, ikke adjektiverne.
Offentlige materialer nævner også billedreferencer som visuelle ankre (ikke kun startframe-animation) (BFL-blog). Behandl stillbilledet som kontrakten; teksten er instruktionen.
Sådan kører du begge stier på FLUX 3 (vurderingsloop)
- Åbn FLUX 3-video (husets model forbliver FLUX 3).
- Vælg sti ud fra tabellen ovenfor.
- Indsæt Prompt A (tekst) eller Prompt B (billede-til-video) med dit rigtige produktnavn.
- Vurdér med tjeklisten nedenfor → behold én vinder.
- Valgfrit: polish et still på billede, og animér igen.
Sigt første udkast omkring 8–12 sekunder, selvom offentlige materialer diskuterer klip på op til omkring 20 sekunder (The Decoder; BFL-blog). Kortere beats er nemmere at læse på telefon.
Prompt A — tekst til video multi-shot (copy-paste)
Vertical 9:16 short, about 10 seconds, soft daylight bedroom UGC.
Shot 1 medium: creator in gray hoodie holds a matte white product box to camera, natural smile.
Shot 2 close hands: opens lid smoothly, tissue paper folds read clearly.
Shot 3 product close-up: lifts the item toward lens, subtle specular highlight.
Same hoodie, same box color, continuous bedroom background.
Quiet room tone, soft paper rustle SFX, conversational energy, no music bed, no on-screen text, no watermark.
Prompt B — billede til video fra et låst still (copy-paste)
Brug, efter du har vedhæftet et rent produkt- eller karakterstill på video.
Image-to-video, about 8 seconds, gentle orbital move then settle.
Preserve the exact product shape, materials, colors, and logo from the reference still.
Keep the same lighting direction and background cleanliness.
Soft studio whoosh on the settle frame, no new text, no watermark, no extra products, no music bed.
Prompt C — still-håndværk, derefter animation (hybridtekst til billedsiden)
Generér en ren lås på billede, og brug derefter Prompt B:
Studio packshot, single matte white wireless earbud case centered on seamless light gray, soft top light, sharp logo edges, empty background, product photography, no text overlay, no watermark, high detail materials.
Godkend/kassér-tjekliste (virker på begge stier)
Se én gang uden at scrube, derefter scrub:
- Sti-fit — opfandt du, når du skulle have låst, eller låste du, når du havde brug for frihed?
- Identitet / produkt — samme ansigt, garderobe eller logo gennem klippet?
- Hænder / kanter — smeltende æske, ekstra fingre, glidende labels?
- Lyd — matcher begivenheder, eller bad du om stilhed? Native lyd er del af den officielle multimodale fortælling (@bfl_ai; The Decoder).
- Beskæring — motivet sikkert til 9:16 Reels/TikTok-agtige placeringer (hold centre læsbare til feed-annoncer—se Meta Ads-oversigt og TikTok Ads Help).
- Tekstforurening — tilfældige glyffer eller vandmærker?
Hvis to punkter falder → skift sti eller still, ikke bare tilføj adjektiver.
Almindelige fejl
| Fejl | Hvorfor det rammer | Fix | | --- | --- | --- | | Tekst-til-video til juridisk emballage | Logoet opfindes | Rigtigt still + billede-til-video | | Billede-til-video-prompt omskriver produktet | Kæmper mod stillbilledet | Kun bevægelse/kamera/lyd | | Travlt still (mange objekter) | Bevægelsen sætter ikke fast på det rigtige | Beskær til ét hero-motiv | | Ingen skudliste på nogen sti | Kontinuerlig grød | Nummerér Shot 1/2/3 | | Maks varighed første gang | Ulæselige beats | Start ca. 8–12 s | | Musik + dialog + SFX på én gang | Mudret lyd | Én lydprioritetslinje |
Scenarievindere (hvis / så)
| Hvis… | Så start med… | Hvorfor | | --- | --- | --- | | Du kun har en énlinjet idé | Tekst til video | Hurtigste loop | | Brandet sendte et packshot-PNG | Billede til video | Geometrien er allerede sandhed | | Karakteren ser kun godt ud i ét still | Hybrid | Frys look, variér kamera | | Multi-shot-dialogtest | Tekst til video først | Grammatik før låse | | Logoet faldt igennem to gange i tekst | Stop → still + i2v | Brænd ikke flere opfind-runs | | Udforsker camcorder vs. animationsstil | Tekst til video | Stilen er eksperimentet (BFL-stilrække) |
Det vi ved vs. det vi ikke ved
| Vi ved (kildebelagt) | Vi ved ikke / vil ikke påstå | | --- | --- | | FLUX 3 offentlig lancering 23. juli 2026 med multimodal video + lyd-ramme (@bfl_ai; BFL-blog; wire-opsummering) | At hver host eksponerer identiske startframe-kontroller eller varigheder | | Officiel videoliste inkluderer tekst-til-video og billede-til-video (startframe eller billedreferencer) (BFL-blog) | Garanti for første-take-logoperfektion for hver SKU | | Klip på op til omkring 20 sekunder med native lyd optræder i offentlige materialer (BFL-blog; The Decoder) | At længere altid er bedre til sociale annoncer | | Multi-shot-kæder optræder i tidlige creator-noter (venturetwins) | Uafhængige filmbranche-certificeringer, der rangerer én sti permanent »bedre« |
FAQ
Hvad er forskellen på FLUX 3 tekst-til-video og billede-til-video?
Tekst-til-video bygger klippet udelukkende fra et skrevet prompt. Billede-til-video betinges af et still—enten som startframe at animere eller som visuel reference—og følger derefter dine bevægelses- og lydinstruktioner (BFL-blog).
Hvilken sti skal jeg bruge først på flux3.video?
Hvis du har intet godkendt still, start tekst til video. Hvis brandlooket allerede er fast, start billede til video på samme videogenerator.
Kan jeg bruge begge i ét projekt?
Ja. Mange teams opdager med tekst, låser et still på billede eller fra et foto, og afslutter med billede-til-video.
Inkluderer billede-til-video lyd?
Offentlige FLUX 3-videofunktioner lister native lydgenerering med outputs, inklusive billedbetingede stier i samme capability-sæt (BFL-blog; The Decoder). Lyt alligevel til hvert take.
Hvor langt skal mit første klip være?
Den øvre længde, der nævnes offentligt, er omkring 20 sekunder (BFL-blog). Til beslutninger, start 8–12 sekunder, så stikvaliteten er åbenlys.
Hvorfor knækker mit produktlogo i tekst-til-video?
Modellen opfinder pixels. Skift til et rigtigt still + billede til video, og forbyd ny tekst i promptet.
Hvorfor ignorerer billede-til-video mit still?
Som regel er stillbilledet rodet, eller promptet beskriver et andet produkt. Beskær til ét motiv; skriv kun bevægelse + kamera + lyd.
Har jeg brug for billedgeneratoren?
Kun til hybridlåse. Ren tekst og rent foto→video kan springe den over. Stills ligger på billede, når du har brug for dem.
Hvor passer multi-shot-prompts ind?
Begge stier. Nummerér shots eksplicit—se multi-shot og native lyd.
Er det her det samme som en peer-model-rangeringsartikel?
Nej. Denne side er stivalg inde i FLUX 3. Til kriterier vs. andre systemer, læs FLUX 3 vs. peer AI-videomodeller.
Hvor prøver jeg gratis?
Åbn FLUX 3-video på flux3.video, og start gratis—intet kort kræves for at begynde.
Om Reese Okada
Reese Okada er AI-videoworkflow-skribent, der omsætter multi-shot-prompts til gentagelige browserworkflows på FLUX 3. Denne guide fokuserer på at vælge tekst vs. still-først, så gratis runs går til den sti, der matcher jobbet.
