Den 23. juli 2026 præsenterede Black Forest Labs FLUX 3—en multimodal frontier-model, der rammesættes som ét system til billede, video, lyd og handlingsforudsigelse, ikke en bunke separate værktøjer syet sammen bag en fælles UI (officiel annonceringstråd; BFL-blog; BFL-modelside).
Den offentlige fortælling er enkel: fælles træning på tværs af modaliteter, så generationer føles tættere på virkeligheden på tværs af stilarter—inklusive hverdagsagtige, ikke-filmiske looks (BFL-lanceringspost; Business Wire / Markets Insider-wire).
Denne artikel er et lanceringskort til creators: hvad de officielle materialer faktisk hævder, hvilke videofunktioner der tæller først (længde, multi-shot, native lyd), og hvordan du prøver FLUX 3 gratis i browseren på flux3.video. Til et hands-on multi-shot-workflow, læs følgesguiden: FLUX 3-video: multi-shot, ca. 20 s-klip og native lyd.
Kort sagt
FLUX 3 er Black Forest Labs’ multimodale foundation-model fra 23. juli 2026. Officiel positionering: én arkitektur, der lærer fælles fra billeder, video og lyd, med en sti til handlingsforudsigelse for robotikpartnere (BFL-blog; BFL-modeller). Offentlige video-highlights omfatter klip på op til omkring 20 sekunder, multi-shot-sekvenser fra ét prompt og native lyd (lydeffekter, atmosfære, dialog) (The Decoder-opsummering af BFL-materialer; early access-noter fra Justine Moore / a16z). På FLUX 3 (dette produkt) åbner du videogeneratoren eller billedgeneratoren og starter gratis—intet kort kræves for at prøve.
Det vigtigste
- Lanceringsdato: 23. juli 2026 for den offentlige FLUX 3-lancering (@bfl_ai; bfl.ai/blog/flux-3).
- Omfang: billede + video + lyd + handlingsforudsigelse under ét multimodalt design (BFL-modeller; wire-release).
- Video-headlines: op til ca. 20 s generation, multi-shot fra ét prompt, native lyd (The Decoder; venturetwins’ tidlige noter).
- Seriekontekst: FLUX.1 (billedæraen 2024) → FLUX.2 billede/redigering (nov. 2025) → FLUX 3 multimodale real-world-modeller (BFL FLUX.2-post; BFL FLUX 3-post).
- Prøvesti her: FLUX 3-video (standard til korte klip) og FLUX 3-billede i samme produktworkspace.
Hvad der faktisk blev lanceret
1. Ét samlet multimodalt pitch—ikke »video boltet på billedet«
Black Forest Labs beskriver FLUX 3 som fælles læring fra billeder, video og lyd inde i en samlet arkitektur, fordi ingen enkelt modalitet fanger verden alene (BFL-blog; The Decoder). Virksomheden rammesætter det som fremskridt mod visuel intelligens i den virkelige verden—modeller, der opfatter, forudsiger og (via partnere) handler (BFL-annonceringstråd).

Hverdags- til filmisk still-sprog · showcase-stilbillede på FLUX 3
2. Video: længde, multi-shot, native lyd
Offentlige materialer og rapportering i lanceringsugen fremhæver:
| Evne | Offentlig påstand | Primærkilder | | --- | --- | --- | | Varighed | Videoklip på op til omkring 20 sekunder | The Decoder; CryptoBriefing | | Multi-shot | Flere klip / vinkler fra ét prompt | Justine Moore (a16z) | | Native lyd | Lyd, der følger klippet (SFX, atmosfære, dialogstier) | BFL-lanceringsramme; The Decoder | | Grænseflader | Tekst-til-video, billede-til-video og relaterede videoworkflows i den offentlige fortælling | The Decoder; produktsti på videogeneratoren her |
Tidlige præferencetabeller i lanceringsdækning (for eksempel korte 720p-sammenligninger mod andre videosystemer) er leverandørrapporterede tidlige signaler, ikke uafhængige filmbranche-certificeringer (The Decoder-opsummering af diagrammet). Brug dem som kontekst, og vurdér derefter dine egne prompts.

Prompt-først bevægelsessprog · showcase-keyframe på FLUX 3
3. Billedsti i samme familie
Officielle posts viser FLUX 3 Image-samples og beskriver syntese/redigering på tværs af stilarter, billedformater og opløsninger som del af det multimodale system (BFL-tråd PS-samples; BFL-blog). Her ligger stillbilleder på billedgeneratoren med FLUX 3 som husets billedstandard.
4. Handling / robotik (kontekst, ikke det primære creator-CTA)
BFL annoncerede også FLUX-mimic-arbejde med Mimic Robotics, inklusive industrielle testfortællinger med Audi (BFL-handlingspost i lanceringstråden; wire-release). Det betyder noget for »world model«-fortællingen. Til sociale annoncer, produktdemos og kortfilm er den praktiske overflade stadig video- + billedgenerering.
5. Serietidslinje (FLUX → FLUX.2 → FLUX 3)
| Generation | Offentligt tema | Anker | | --- | --- | --- | | FLUX.1-æraen | Open/billedgenereringsbølge, der gjorde FLUX til et creator-standardvalg | Seriehistorie på BFL / Wikipedia-oversigt | | FLUX.2 | Produktionsbilledgenerering og -redigering (multi-reference, højere fidelity) | FLUX.2-blog, 25. nov. 2025 | | FLUX 3 | Multimodal video + lyd + billede-rygrad | FLUX 3-blog, 23. juli 2026 |
Dyk ned: hvem FLUX 3 er til
Sociale og UGC-marketers
Korte klip, der holder ansigter, bevægelse og hverdagslys—uden at booke en hel produktionsdag—er de jobs, multi-shot + native lyd muliggør. Start på tekst til video.
Produkt- og growth-teams
Billede-til-video vender et emballagebillede eller et hero-produktstill til en første motion-annonce. Brug et rent still, og animér derefter i samme videoworkspace.
AI-filmmagere og storyboardere
Multi-shot fra ét prompt er det, creators i lanceringsugen bliver ved med at poste om (venturetwins). Behandl tidlige outputs som redigerbare første takes, og finjustér derefter prompts shot for shot.
Still-designere, der allerede lever i FLUX
Hvis du kender FLUX fra stills, er FLUX 3’s offentlige fortælling »samme familie, nu tid + lyd«. Hold stills på billede og bevægelse på video.
Det vi ved vs. det vi ikke ved
| Vi ved (kildebelagt) | Vi ved ikke / vil ikke påstå | | --- | --- | | Offentlig lancering 23. juli 2026 med multimodal positionering (@bfl_ai; BFL-blog) | At hver host, opløsning eller varighedskontakt er identisk på tværs af alle produkter verden over | | Videofortællingen inkluderer ca. 20 s, multi-shot, native lyd (The Decoder) | Garanti for første-take-perfektion for hvert ansigt, hver hånd og hver fuld kropsvending | | Tidlige præferencescores findes i lanceringsdækning og er foreløbige (The Decoder) | Uafhængige, peer-reviewede leaderboards, der kroner en permanent »#1-videomodel« | | FLUX.2 etablerede et stærkt billedkapitel (BFL FLUX.2) | At stills og video altid deler det præcis samme æstetiske fingeraftryk på hvert seed | | Her vises browser-video- og billede-generatorer til FLUX 3-workflows | Krydsleverandør-dollar-per-sekund-pristabeller (sammenlignes ikke her) |
Hvorfor det betyder noget for folk, der bygger med det
- Video + lyd i én generation betyder færre hop mellem værktøjer, når du laver første annoncer og explainers.
- Multi-shot-prompts ændrer, hvordan du skriver opgaver—skriv klip, ikke kun vibes (tidlige multi-shot-noter).
- FLUX-brandkontinuitet hjælper teams, der allerede skriver prompts i FLUX-stillsprog, med at flytte motion-arbejde uden en ny mental model.
- Browser-prøvestier slår at vente på en perfekt lokal installation, når du bare skal vide, om dit produktshot overlever bevægelse.
Sådan vurderer du FLUX 3 selv her
- Åbn FLUX 3-videogeneratoren.
- Indsæt Prompt A nedenfor (multi-shot).
- Se én gang i fuld skærm: ansigter, klipklarhed, lydpasning (hvis der er lyd), og om 9:16-beskæringen holder.
- Gem de takes, du vil beholde; valgfri anden runde med billede til video fra et still, du allerede kan lide, på billede.
Prompt A — multi-shot baggårdsturnering
Multi-shot short film, 12 seconds, playful daylight backyard.
Shot 1 wide: two kids jousting with bright pool noodles, green grass, summer sun.
Shot 2 medium: slow motion near-miss as noodles clash, fabric and hair motion clear.
Shot 3 close-up: both kids laughing, natural faces, soft bokeh fence in background.
Natural ambient audio feel, no music bed, no text overlays, no watermark.
Prompt B — produkt-hero-spin
Product commercial, 8 seconds, clean studio.
Shot 1: matte black wireless earbuds case on white seamless, soft key light.
Shot 2: lid opens smoothly, earbuds catch a specular highlight.
Shot 3: earbud floats closer to camera, macro detail on mesh.
Subtle whoosh SFX energy, no logos other than the product shape, no watermark.
Prompt C — regnfuld neon-gade (stemning)
Cinematic street clip, 10 seconds, night rain, neon reflections.
Single continuous push-in toward a woman laughing under a translucent umbrella,
wet asphalt, cyan and magenta signs, handheld micro-motion, natural skin texture.
City ambience and light rain SFX, no dialogue, no on-screen text, no watermark.
Hvad du skal holde øje med herefter
- Creator-multi-shot-opskrifter (skudlister som prompts)—se vores multi-shot-how-to.
- Billedworkflows til stills, der fodrer billede-til-video (billedgenerator).
- Officielle BFL-researchnoter om Self-Flow / multimodal rygrad, efterhånden som de udgiver mere (BFL-researchhub via The Decoders arkitekturopsummering).
FAQ
Hvad er FLUX 3?
FLUX 3 er Black Forest Labs’ multimodale foundation-model fra 23. juli 2026 til billede, video, lyd og handlingsforudsigelse, trænet fælles frem for som separate specialmodeller (BFL-blog; lanceringstråd).
Er FLUX 3 kun en videomodel?
Nej. Offentlige materialer beskriver stier til video, billede, lyd og handling under ét multimodalt design (BFL-modeller). Her kan du starte med video eller billede.
Hvor lange kan FLUX 3-videoer være?
Lanceringsrapportering citerer klip på op til omkring 20 sekunder i BFL’s offentlige fortælling (The Decoder). Bekræft altid den varighedskontrol, der er tilgængelig i generator-UI’en for dit run.
Understøtter FLUX 3 multi-shot i ét prompt?
Ja—det er et creator-highlight fra lanceringsugen: flere klip fra ét prompt (venturetwins). Skriv eksplicitte linjer med Shot 1 / Shot 2 / Shot 3 for bedst kontrol.
Hvad er native lyd i FLUX 3?
Native lyd betyder, at modellen kan producere lyd sammen med videoen—atmosfære, SFX og dialogorienterede demos optræder i offentlig dækning (The Decoder; BFL-lancering).
Hvordan adskiller FLUX 3 sig fra FLUX.2?
FLUX.2 (nov. 2025) er kapitlet om billedgenerering og -redigering til produktion (BFL FLUX.2). FLUX 3 udvider familien til et multimodalt system med video + lyd som førsteklasses storytelling (BFL FLUX 3).
Kan jeg prøve FLUX 3 gratis online?
Ja. Åbn FLUX 3-videogeneratoren på flux3.video for at starte gratis—intet kort kræves for at begynde. Stills: billedgenerator.
Tekst til video eller billede til video—hvad først?
Brug tekst til video, når du opfinder en scene fra bunden. Brug billede til video, når du allerede har et produktfoto eller et karakterstill, du vil animere—begge ligger under video.
Er de publicerede win-rate-sammenligninger endelige?
Nej. Tidlige præferencerater i lanceringsartikler er foreløbige leverandørrapporterede signaler under specifikke testbetingelser (The Decoder). Kør dine egne prompts, når beslutningen betyder noget.
Hvor skal jeg starte lige nu?
Indsæt Prompt A i videogeneratoren, se én gang i fuld skærm, og iterér derefter shot-beskrivelser—ikke kun adjektiver.
Om Avery Lin
Avery Lin er AI-model-release-analytiker, der følger FLUX-familiens lanceringer og omsætter offentlige modelfakta til klare prøvestier for creators på FLUX 3.
