23. juli 2026 presenterte Black Forest Labs FLUX 3 — en multimodal spissmodell posisjonert som ett system for bilde, video, lyd og handlingsprediksjon, ikke en haug separate verktøy sydd sammen bak samme grensesnitt (offisiell kunngjøringstråd; BFL-blogg; BFL-modellside).
Den offentlige historien er enkel: felles trening på tvers av modaliteter, slik at genereringene føles mer livaktige i flere stiler — også hverdagslige, ikke-filmiske uttrykk (BFL-lanseringsinnlegg; Business Wire / Markets Insider).
Dette er et lanseringskart for skapere: hva de offisielle materialene faktisk hevder, hvilke videofunksjoner som teller først (lengde, flere klipp, innebygd lyd), og hvordan du prøver FLUX 3 gratis i nettleseren på flux3.video. For en praktisk arbeidsflyt med flere klipp, les følgegennomgangen: FLUX 3-video: flere klipp, ca. 20 s og innebygd lyd.
TLDR
FLUX 3 er Black Forest Labs sin multimodale grunnmodell fra 23. juli 2026. Offisiell posisjonering: én arkitektur som lærer samlet fra bilder, video og lyd, med en vei for handlingsprediksjon til robotikkpartnere (BFL-blogg; BFL-modeller). Offentlige video-høydepunkter inkluderer klipp på opptil omtrent 20 sekunder, sekvenser med flere klipp fra én prompt, og innebygd lyd (lydeffekter, atmosfære, dialog) (The Decoder-sammendrag av BFL-materiale; tidlig-tilgangsnotater fra Justine Moore / a16z). På FLUX 3 (dette produktet) åpner du videogeneratoren eller bildegeneratoren og starter gratis — uten kort for å prøve.
Hovedpunkter
- Lanseringsdato: 23. juli 2026 for den offentlige FLUX 3-lanseringen (@bfl_ai; bfl.ai/blog/flux-3).
- Omfang: Bilde + video + lyd + handlingsprediksjon under ett multimodalt design (BFL-modeller; nyhetsmelding).
- Videohøydepunkter: opptil ca. 20 s generering, flere klipp fra én prompt, innebygd lyd (The Decoder; tidlige notater fra venturetwins).
- Seriekontekst: FLUX.1 (bildeæraen 2024) → FLUX.2 bilde/redigering (november 2025) → FLUX 3 multimodale modeller for den virkelige verden (BFL FLUX.2-innlegg; BFL FLUX 3-innlegg).
- Prøvevei her: FLUX 3-video (standard for korte klipp) og FLUX 3-bilde i samme produktarbeidsområde.
Hva som faktisk ble lansert
1. Ett samlet multimodalt budskap — ikke «video klistret på bilde»
Black Forest Labs beskriver FLUX 3 som felles læring fra bilder, video og lyd inne i en samlet arkitektur, fordi ingen enkelt modalitet fanger verden alene (BFL-blogg; The Decoder). Selskapet rammer dette som framskritt mot visuell intelligens i den virkelige verden — modeller som oppfatter, forutsier og (via partnere) handler (BFL-kunngjøringstråd).

Fra hverdag til filmisk stillbilde-språk · visningsstil-ramme på FLUX 3
2. Video: lengde, flere klipp, innebygd lyd
Offentlig materiale og dekning i lanseringsuken legger vekt på:
| Evne | Offentlig påstand | Primærkilder | | --- | --- | --- | | Varighet | Videoklipp på opptil omtrent 20 sekunder | The Decoder; CryptoBriefing | | Flere klipp | Flere klipp / vinkler fra én prompt | Justine Moore (a16z) | | Innebygd lyd | Lyd som følger klippet (lydeffekter, atmosfære, dialogveier) | BFL-lanseringsramme; The Decoder | | Grensesnitt | Tekst til video, bilde til video og relaterte videoflyter i den offentlige fortellingen | The Decoder; produktvei på videogeneratoren her |
Tidlige preferansetabeller publisert i lanseringsdekning (for eksempel korte 720p-sammenligninger mot andre videosystemer) er leverandørrapporterte tidlige signaler, ikke uavhengige filmsertifiseringer (The Decoder-sammendrag av diagram). Bruk dem som kontekst, og vurder deretter dine egne prompts.

Prompt-først bevegelsesspråk · visningsbilde på FLUX 3
3. Bildevei i samme familie
Offisielle innlegg viser FLUX 3 Image-eksempler og beskriver syntese/redigering på tvers av stiler, sideforhold og oppløsninger som del av den multimodale modellfamilien (BFL-tråd med PS-eksempler; BFL-blogg). Her bor stillbilder på bildegeneratoren med FLUX 3 som standard bildemodell.
4. Handling / robotikk (kontekst, ikke hoved-CTA for skapere)
BFL kunngjorde også FLUX-mimic-arbeid med Mimic Robotics, inkludert industrielle testfortellinger som involverer Audi (BFL-handlingsinnlegg i lanseringstråden; nyhetsmelding). Det er viktig for «verdensmodell»-historien. For sosiale annonser, produktdemoer og kortfilm er den praktiske flaten fortsatt video- og bildegenerering.
5. Serietidslinje (FLUX → FLUX.2 → FLUX 3)
| Generasjon | Offentlig tema | Anker | | --- | --- | --- | | FLUX.1-æraen | Åpen/bildegenereringsbølge som gjorde FLUX til en standard for skapere | Seriehistorie på BFL / Wikipedia-oversikt | | FLUX.2 | Produksjonsbildegenerering og redigering (flere referanser, høyere troskap) | FLUX.2-blogg, 25. nov. 2025 | | FLUX 3 | Multimodal video + lyd + bilde-ryggrad | FLUX 3-blogg, 23. juli 2026 |
Dypdykk: hvem FLUX 3 er for
Sosiale og UGC-markedsførere
Korte klipp som holder ansikter, bevegelse og hverdagslys — uten å leie inn en hel produksjonsdag — er jobbene flere klipp + innebygd lyd gjør mulige. Start på tekst til video.
Produkt- og vekstteam
Bilde til video gjør et emballasjestillbilde eller et hero-produktbilde om til en første bevegelsesannonse. Bruk et rent stillbilde, og animer deretter i samme videoarbeidsområde.
AI-filmskapere og storyboardere
Flere klipp fra én prompt er forskjellen skapere i lanseringsuken stadig legger ut om (venturetwins). Behandle tidlige resultater som redigerbare førsteutkast, og finjuster deretter promptene klipp for klipp.
Stillbildedesignere som allerede lever i FLUX
Hvis du kjenner FLUX for stillbilder, er den offentlige FLUX 3-historien «samme familie, nå tid + lyd». Behold stillbilder på bilde og bevegelse på video.
Hva vi vet mot hva vi ikke vet
| Vi vet (kildebelagt) | Vi vet ikke / vil ikke påstå | | --- | --- | | Offentlig lansering 23. juli 2026 med multimodal posisjonering (@bfl_ai; BFL-blogg) | At hver vert, oppløsning eller varighetsbryter er identisk i alle produkter verden over | | Videofortellingen inkluderer ca. 20 s, flere klipp, innebygd lyd (The Decoder) | Garantert perfekt første opptak for hvert ansikt, hver hånd og hver helkroppsvending | | Tidlige preferansescore finnes i lanseringsdekning og er foreløpige (The Decoder) | Uavhengige, fagfellevurderte rangeringer som kroner en permanent «#1-videomodell» | | FLUX.2 etablerte et sterkt bildekapittel (BFL FLUX.2) | At stillbilder og video alltid deler nøyaktig samme estetiske fingeravtrykk på hvert seed | | Her finnes video- og bilde-generatorer i nettleseren for FLUX 3-arbeidsflyter | Pristabeller i dollar per sekund på tvers av leverandører (ikke sammenlignet her) |
Hvorfor dette betyr noe for de som bygger
- Video + lyd i én generering reduserer hopping mellom verktøy for første annonser og forklaringer.
- Prompting med flere klipp endrer hvordan du skriver oppdrag — skriv klipp, ikke bare stemning (tidlige multi-shot-notater).
- Kontinuitet i FLUX-merket hjelper team som allerede promptter i FLUX-stillbildespråk med å flytte bevegelsesarbeid uten en ny mental modell.
- Prøveveier i nettleseren slår å vente på en perfekt lokal installasjon når du bare trenger å vite om ditt produktbilde overlever bevegelse.
Slik vurderer du FLUX 3 selv her
- Åpne FLUX 3-videogeneratoren.
- Lim inn Prompt A under (flere klipp).
- Se én gang i fullskjerm: ansikter, klippklarhet, lydtreff (hvis den er der), og om 9:16-utsnittet fortsatt viser motivet.
- Lagre de beste; valgfritt andre pass med bilde til video fra et stillbilde du allerede liker på bilde.
Prompt A — bakgårdsduell med flere klipp
Multi-shot short film, 12 seconds, playful daylight backyard.
Shot 1 wide: two kids jousting with bright pool noodles, green grass, summer sun.
Shot 2 medium: slow motion near-miss as noodles clash, fabric and hair motion clear.
Shot 3 close-up: both kids laughing, natural faces, soft bokeh fence in background.
Natural ambient audio feel, no music bed, no text overlays, no watermark.
Prompt B — produkthero-spinn
Product commercial, 8 seconds, clean studio.
Shot 1: matte black wireless earbuds case on white seamless, soft key light.
Shot 2: lid opens smoothly, earbuds catch a specular highlight.
Shot 3: earbud floats closer to camera, macro detail on mesh.
Subtle whoosh SFX energy, no logos other than the product shape, no watermark.
Prompt C — regnfull neongate (stemning)
Cinematic street clip, 10 seconds, night rain, neon reflections.
Single continuous push-in toward a woman laughing under a translucent umbrella,
wet asphalt, cyan and magenta signs, handheld micro-motion, natural skin texture.
City ambience and light rain SFX, no dialogue, no on-screen text, no watermark.
Hva du bør følge med på videre
- Oppskrifter med flere klipp for skapere (opptakslister som prompts) — se veiledningen for flere klipp.
- Bildeflyter for stillbilder som mates inn i bilde til video (bildegenerator).
- Offisielle BFL-forskningsnotater om Self-Flow / multimodal ryggrad etter hvert som de publiserer mer (BFL-forskningshub via The Decoder sitt arkitektursammendrag).
FAQ
Hva er FLUX 3?
FLUX 3 er Black Forest Labs sin multimodale grunnmodell fra 23. juli 2026 for bilde, video, lyd og handlingsprediksjon, trent samlet i stedet for som separate enkeltformålsmodeller (BFL-blogg; lanseringstråd).
Er FLUX 3 bare en videomodell?
Nei. Offentlig materiale beskriver veier for video, bilde, lyd og handling under ett multimodalt design (BFL-modeller). Her kan du starte med video eller bilde.
Hvor lange kan FLUX 3-videoer være?
Lanseringsdekning siterer klipp på opptil omtrent 20 sekunder i BFLs offentlige fortelling (The Decoder). Bekreft alltid varighetskontrollen som er tilgjengelig i generatorens grensesnitt for din kjøring.
Støtter FLUX 3 flere klipp i én prompt?
Ja — det er et høydepunkt for skapere i lanseringsuken: flere klipp fra én prompt (venturetwins). Skriv eksplisitte Shot 1 / Shot 2 / Shot 3-linjer for best kontroll.
Hva er innebygd lyd i FLUX 3?
Innebygd lyd betyr at modellen kan lage lyd sammen med videoen — atmosfære, lydeffekter og dialogorienterte demoer dukker opp i offentlig dekning (The Decoder; BFL-lansering).
Hvordan skiller FLUX 3 seg fra FLUX.2?
FLUX.2 (november 2025) er produksjonskapittelet for bildegenerering og redigering (BFL FLUX.2). FLUX 3 utvider familien til et multimodalt system med video + lyd som førsteklasses historiefortelling (BFL FLUX 3).
Kan jeg prøve FLUX 3 gratis på nett?
Ja. Åpne FLUX 3-videogeneratoren på flux3.video for å starte gratis — uten kort for å begynne. Stillbilder: bildegenerator.
Tekst til video eller bilde til video — hva først?
Bruk tekst til video når du finner opp en scene fra bunnen. Bruk bilde til video når du allerede har et produktfoto eller karakterstillbilde du vil animere — begge ligger under video.
Er de publiserte seierstalls-sammenligningene endelige?
Nei. Tidlige preferanserater i lanseringsartikler er foreløpige leverandørrapporterte signaler under spesifikke testforhold (The Decoder). Kjør dine egne prompts for beslutninger som teller.
Hvor bør jeg starte akkurat nå?
Lim inn Prompt A i videogeneratoren, se én gang i fullskjerm, og iterer deretter klippbeskrivelsene — ikke bare adjektivene.
Om Avery Lin
Avery Lin er analytiker for AI-modelllanseringer som følger FLUX-familiens lanseringer og gjør offentlige modellfakta om til tydelige prøveveier for skapere på FLUX 3.
