Tidsbegrenset 30 % rabatt!Få tilbudet

Hva er FLUX 3? Multimodal video og bilde, gratis på nett

Skrevet av Avery Lin · Publisert 2026-07-24 flux-3flux3black-forest-labsrelease-watchai-videotext-to-videomultimodal
Hva er FLUX 3? Multimodal video og bilde, gratis på nett

23. juli 2026 presenterte Black Forest Labs FLUX 3 — en multimodal spissmodell posisjonert som ett system for bilde, video, lyd og handlingsprediksjon, ikke en haug separate verktøy sydd sammen bak samme grensesnitt (offisiell kunngjøringstråd; BFL-blogg; BFL-modellside).

Den offentlige historien er enkel: felles trening på tvers av modaliteter, slik at genereringene føles mer livaktige i flere stiler — også hverdagslige, ikke-filmiske uttrykk (BFL-lanseringsinnlegg; Business Wire / Markets Insider).

Dette er et lanseringskart for skapere: hva de offisielle materialene faktisk hevder, hvilke videofunksjoner som teller først (lengde, flere klipp, innebygd lyd), og hvordan du prøver FLUX 3 gratis i nettleserenflux3.video. For en praktisk arbeidsflyt med flere klipp, les følgegennomgangen: FLUX 3-video: flere klipp, ca. 20 s og innebygd lyd.

TLDR

FLUX 3 er Black Forest Labs sin multimodale grunnmodell fra 23. juli 2026. Offisiell posisjonering: én arkitektur som lærer samlet fra bilder, video og lyd, med en vei for handlingsprediksjon til robotikkpartnere (BFL-blogg; BFL-modeller). Offentlige video-høydepunkter inkluderer klipp på opptil omtrent 20 sekunder, sekvenser med flere klipp fra én prompt, og innebygd lyd (lydeffekter, atmosfære, dialog) (The Decoder-sammendrag av BFL-materiale; tidlig-tilgangsnotater fra Justine Moore / a16z). På FLUX 3 (dette produktet) åpner du videogeneratoren eller bildegeneratoren og starter gratis — uten kort for å prøve.

Hovedpunkter

Hva som faktisk ble lansert

1. Ett samlet multimodalt budskap — ikke «video klistret på bilde»

Black Forest Labs beskriver FLUX 3 som felles læring fra bilder, video og lyd inne i en samlet arkitektur, fordi ingen enkelt modalitet fanger verden alene (BFL-blogg; The Decoder). Selskapet rammer dette som framskritt mot visuell intelligens i den virkelige verden — modeller som oppfatter, forutsier og (via partnere) handler (BFL-kunngjøringstråd).

Filmisk stillbilde-følelse for FLUX 3-videorealisme — visning på FLUX 3

Fra hverdag til filmisk stillbilde-språk · visningsstil-ramme på FLUX 3

2. Video: lengde, flere klipp, innebygd lyd

Offentlig materiale og dekning i lanseringsuken legger vekt på:

| Evne | Offentlig påstand | Primærkilder | | --- | --- | --- | | Varighet | Videoklipp på opptil omtrent 20 sekunder | The Decoder; CryptoBriefing | | Flere klipp | Flere klipp / vinkler fra én prompt | Justine Moore (a16z) | | Innebygd lyd | Lyd som følger klippet (lydeffekter, atmosfære, dialogveier) | BFL-lanseringsramme; The Decoder | | Grensesnitt | Tekst til video, bilde til video og relaterte videoflyter i den offentlige fortellingen | The Decoder; produktvei på videogeneratoren her |

Tidlige preferansetabeller publisert i lanseringsdekning (for eksempel korte 720p-sammenligninger mot andre videosystemer) er leverandørrapporterte tidlige signaler, ikke uavhengige filmsertifiseringer (The Decoder-sammendrag av diagram). Bruk dem som kontekst, og vurder deretter dine egne prompts.

Tekst-til-video-visningsbilde — ørkenjakt-energi · visning på FLUX 3

Prompt-først bevegelsesspråk · visningsbilde på FLUX 3

3. Bildevei i samme familie

Offisielle innlegg viser FLUX 3 Image-eksempler og beskriver syntese/redigering på tvers av stiler, sideforhold og oppløsninger som del av den multimodale modellfamilien (BFL-tråd med PS-eksempler; BFL-blogg). Her bor stillbilder på bildegeneratoren med FLUX 3 som standard bildemodell.

4. Handling / robotikk (kontekst, ikke hoved-CTA for skapere)

BFL kunngjorde også FLUX-mimic-arbeid med Mimic Robotics, inkludert industrielle testfortellinger som involverer Audi (BFL-handlingsinnlegg i lanseringstråden; nyhetsmelding). Det er viktig for «verdensmodell»-historien. For sosiale annonser, produktdemoer og kortfilm er den praktiske flaten fortsatt video- og bildegenerering.

5. Serietidslinje (FLUX → FLUX.2 → FLUX 3)

| Generasjon | Offentlig tema | Anker | | --- | --- | --- | | FLUX.1-æraen | Åpen/bildegenereringsbølge som gjorde FLUX til en standard for skapere | Seriehistorie på BFL / Wikipedia-oversikt | | FLUX.2 | Produksjonsbildegenerering og redigering (flere referanser, høyere troskap) | FLUX.2-blogg, 25. nov. 2025 | | FLUX 3 | Multimodal video + lyd + bilde-ryggrad | FLUX 3-blogg, 23. juli 2026 |

Dypdykk: hvem FLUX 3 er for

Sosiale og UGC-markedsførere

Korte klipp som holder ansikter, bevegelse og hverdagslys — uten å leie inn en hel produksjonsdag — er jobbene flere klipp + innebygd lyd gjør mulige. Start på tekst til video.

Produkt- og vekstteam

Bilde til video gjør et emballasjestillbilde eller et hero-produktbilde om til en første bevegelsesannonse. Bruk et rent stillbilde, og animer deretter i samme videoarbeidsområde.

AI-filmskapere og storyboardere

Flere klipp fra én prompt er forskjellen skapere i lanseringsuken stadig legger ut om (venturetwins). Behandle tidlige resultater som redigerbare førsteutkast, og finjuster deretter promptene klipp for klipp.

Stillbildedesignere som allerede lever i FLUX

Hvis du kjenner FLUX for stillbilder, er den offentlige FLUX 3-historien «samme familie, nå tid + lyd». Behold stillbilder på bilde og bevegelse på video.

Hva vi vet mot hva vi ikke vet

| Vi vet (kildebelagt) | Vi vet ikke / vil ikke påstå | | --- | --- | | Offentlig lansering 23. juli 2026 med multimodal posisjonering (@bfl_ai; BFL-blogg) | At hver vert, oppløsning eller varighetsbryter er identisk i alle produkter verden over | | Videofortellingen inkluderer ca. 20 s, flere klipp, innebygd lyd (The Decoder) | Garantert perfekt første opptak for hvert ansikt, hver hånd og hver helkroppsvending | | Tidlige preferansescore finnes i lanseringsdekning og er foreløpige (The Decoder) | Uavhengige, fagfellevurderte rangeringer som kroner en permanent «#1-videomodell» | | FLUX.2 etablerte et sterkt bildekapittel (BFL FLUX.2) | At stillbilder og video alltid deler nøyaktig samme estetiske fingeravtrykk på hvert seed | | Her finnes video- og bilde-generatorer i nettleseren for FLUX 3-arbeidsflyter | Pristabeller i dollar per sekund på tvers av leverandører (ikke sammenlignet her) |

Hvorfor dette betyr noe for de som bygger

  1. Video + lyd i én generering reduserer hopping mellom verktøy for første annonser og forklaringer.
  2. Prompting med flere klipp endrer hvordan du skriver oppdrag — skriv klipp, ikke bare stemning (tidlige multi-shot-notater).
  3. Kontinuitet i FLUX-merket hjelper team som allerede promptter i FLUX-stillbildespråk med å flytte bevegelsesarbeid uten en ny mental modell.
  4. Prøveveier i nettleseren slår å vente på en perfekt lokal installasjon når du bare trenger å vite om ditt produktbilde overlever bevegelse.

Slik vurderer du FLUX 3 selv her

  1. Åpne FLUX 3-videogeneratoren.
  2. Lim inn Prompt A under (flere klipp).
  3. Se én gang i fullskjerm: ansikter, klippklarhet, lydtreff (hvis den er der), og om 9:16-utsnittet fortsatt viser motivet.
  4. Lagre de beste; valgfritt andre pass med bilde til video fra et stillbilde du allerede liker på bilde.

Prompt A — bakgårdsduell med flere klipp

Multi-shot short film, 12 seconds, playful daylight backyard.
Shot 1 wide: two kids jousting with bright pool noodles, green grass, summer sun.
Shot 2 medium: slow motion near-miss as noodles clash, fabric and hair motion clear.
Shot 3 close-up: both kids laughing, natural faces, soft bokeh fence in background.
Natural ambient audio feel, no music bed, no text overlays, no watermark.

Prompt B — produkthero-spinn

Product commercial, 8 seconds, clean studio.
Shot 1: matte black wireless earbuds case on white seamless, soft key light.
Shot 2: lid opens smoothly, earbuds catch a specular highlight.
Shot 3: earbud floats closer to camera, macro detail on mesh.
Subtle whoosh SFX energy, no logos other than the product shape, no watermark.

Prompt C — regnfull neongate (stemning)

Cinematic street clip, 10 seconds, night rain, neon reflections.
Single continuous push-in toward a woman laughing under a translucent umbrella,
wet asphalt, cyan and magenta signs, handheld micro-motion, natural skin texture.
City ambience and light rain SFX, no dialogue, no on-screen text, no watermark.

Hva du bør følge med på videre

FAQ

Hva er FLUX 3?

FLUX 3 er Black Forest Labs sin multimodale grunnmodell fra 23. juli 2026 for bilde, video, lyd og handlingsprediksjon, trent samlet i stedet for som separate enkeltformålsmodeller (BFL-blogg; lanseringstråd).

Er FLUX 3 bare en videomodell?

Nei. Offentlig materiale beskriver veier for video, bilde, lyd og handling under ett multimodalt design (BFL-modeller). Her kan du starte med video eller bilde.

Hvor lange kan FLUX 3-videoer være?

Lanseringsdekning siterer klipp på opptil omtrent 20 sekunder i BFLs offentlige fortelling (The Decoder). Bekreft alltid varighetskontrollen som er tilgjengelig i generatorens grensesnitt for din kjøring.

Støtter FLUX 3 flere klipp i én prompt?

Ja — det er et høydepunkt for skapere i lanseringsuken: flere klipp fra én prompt (venturetwins). Skriv eksplisitte Shot 1 / Shot 2 / Shot 3-linjer for best kontroll.

Hva er innebygd lyd i FLUX 3?

Innebygd lyd betyr at modellen kan lage lyd sammen med videoen — atmosfære, lydeffekter og dialogorienterte demoer dukker opp i offentlig dekning (The Decoder; BFL-lansering).

Hvordan skiller FLUX 3 seg fra FLUX.2?

FLUX.2 (november 2025) er produksjonskapittelet for bildegenerering og redigering (BFL FLUX.2). FLUX 3 utvider familien til et multimodalt system med video + lyd som førsteklasses historiefortelling (BFL FLUX 3).

Kan jeg prøve FLUX 3 gratis på nett?

Ja. Åpne FLUX 3-videogeneratoren på flux3.video for å starte gratis — uten kort for å begynne. Stillbilder: bildegenerator.

Tekst til video eller bilde til video — hva først?

Bruk tekst til video når du finner opp en scene fra bunnen. Bruk bilde til video når du allerede har et produktfoto eller karakterstillbilde du vil animere — begge ligger under video.

Er de publiserte seierstalls-sammenligningene endelige?

Nei. Tidlige preferanserater i lanseringsartikler er foreløpige leverandørrapporterte signaler under spesifikke testforhold (The Decoder). Kjør dine egne prompts for beslutninger som teller.

Hvor bør jeg starte akkurat nå?

Lim inn Prompt A i videogeneratoren, se én gang i fullskjerm, og iterer deretter klippbeskrivelsene — ikke bare adjektivene.

Om Avery Lin

Avery Lin er analytiker for AI-modelllanseringer som følger FLUX-familiens lanseringer og gjør offentlige modellfakta om til tydelige prøveveier for skapere på FLUX 3.

More Posts