Zeitlich begrenzt 30% Rabatt!Angebot sichern

Was ist FLUX 3? Multimodales Video & Bild, kostenlos online

Geschrieben von Avery Lin · Veröffentlicht am 2026-07-24 flux-3flux3black-forest-labsrelease-watchai-videotext-to-videomultimodal
Was ist FLUX 3? Multimodales Video & Bild, kostenlos online

TLDR

FLUX 3 ist das multimodale Foundation-Modell von Black Forest Labs vom 23. Juli 2026. Offizielle Positionierung: eine Architektur, die gemeinsam aus Bildern, Video und Audio lernt, mit einem Action-Prediction-Pfad für Robotik-Partner (BFL-Blog; BFL-Modelle). Öffentliche Video-Highlights: Clips bis etwa 20 Sekunden, Multi-Shot-Sequenzen aus einem Prompt und natives Audio (Soundeffekte, Atmosphäre, Dialog) (The Decoder Zusammenfassung der BFL-Materialien; Early-Access-Notizen von Justine Moore / a16z). Auf FLUX 3 (dieser Site) öffnen Sie den Video-Generator oder den Image-Generator und starten kostenlos—keine Karte nötig zum Ausprobieren.

Key Takeaways

Was tatsächlich shipped

1. Ein einheitlicher multimodaler Pitch—nicht „Video an Bild angeschraubt“

Black Forest Labs beschreibt FLUX 3 als gemeinsames Lernen aus Bildern, Video und Audio in einer unified Architecture, weil keine einzelne Modalität die Welt allein abbildet (BFL-Blog; The Decoder). Das Unternehmen rahmt das als Fortschritt Richtung real-world visual intelligence—Modelle, die wahrnehmen, vorhersagen und (über Partner) handeln (BFL-Ankündigungs-Thread).

Cinematic Still-Vibe für FLUX-3-Video-Realismus — Showcase auf FLUX 3

Alltags- bis kinematische Still-Sprache · Showcase-Style-Frame auf FLUX 3

2. Video: Länge, Multi-Shot, natives Audio

Öffentliche Materialien und Launch-Week-Berichte betonen:

| Fähigkeit | Öffentliche Aussage | Primärquellen | | --- | --- | --- | | Dauer | Video-Clips bis etwa 20 Sekunden | The Decoder; CryptoBriefing | | Multi-Shot | Mehrere Shots / Winkel aus einem Prompt | Justine Moore (a16z) | | Natives Audio | Sound, der zum Clip passt (SFX, Ambient, Dialog-Pfade) | BFL-Launch-Framing; The Decoder | | Interfaces | Text-to-Video, Image-to-Video und verwandte Video-Workflows in der öffentlichen Narrative | The Decoder; Produktpfad auf dem Video-Generator dieser Site |

Frühe Preference-Tabellen in Launch-Coverage (z. B. kurze 720p-Vergleiche vs. andere Video-Systeme) sind vendor-reported early signals, keine unabhängigen Film-Industrie-Zertifizierungen (The Decoder Chart-Summary). Nutzen Sie sie als Kontext, dann beurteilen Sie Ihre eigenen Prompts.

Text-to-Video-Keyframe-Style — Desert-Chase-Energy · Showcase auf FLUX 3

Prompt-first Motion Language · Showcase-Keyframe auf FLUX 3

3. Image-Pfad in derselben Familie

Offizielle Posts zeigen FLUX 3 Image-Samples und beschreiben Synthesis/Editing über Stile, Aspect Ratios und Auflösungen als Teil des multimodalen Stacks (BFL-Thread PS-Samples; BFL-Blog). Auf diesem Produkt leben Stills im Image-Generator mit FLUX 3 als House-Image-Default.

4. Action / Robotik (Kontext, nicht der Haupt-Creator-CTA)

BFL kündigte auch FLUX-mimic-Arbeit mit Mimic Robotics an, inklusive industrieller Test-Narrative mit Audi (BFL Action-Post im Launch-Thread; Wire-Release). Das ist wichtig für die „World Model“-Story. Für Social Ads, Produktdemos und Kurzfilme bleibt die praktische Oberfläche Video + Image Generation.

5. Serien-Timeline (FLUX → FLUX.2 → FLUX 3)

| Generation | Öffentliches Thema | Anker | | --- | --- | --- | | FLUX.1-Ära | Open/Image-Generation-Welle, die FLUX zum Creator-Default machte | Serien-Historie auf BFL / Wikipedia-Überblick | | FLUX.2 | Produktionsreife Image Generation & Editing (Multi-Reference, höhere Fidelity) | FLUX.2-Blog, 25. Nov 2025 | | FLUX 3 | Multimodales Video + Audio + Image-Backbone | FLUX-3-Blog, 23. Juli 2026 |

Deep Dive: für wen FLUX 3 gedacht ist

Social- und UGC-Marketer

Kurze Clips, die Gesichter, Motion und Alltagslicht halten—ohne einen vollen Produktionstag—sind die Jobs, die Multi-Shot + natives Audio freischalten. Starten Sie bei Text to Video.

Product- und Growth-Teams

Image-to-Video macht aus einem Packaging-Still oder Hero-Product-Frame einen First-Pass-Motion-Ad. Nutzen Sie ein sauberes Still, dann animieren Sie im selben Video-Workspace.

AI-Filmmaker und Storyboarder

One-Prompt-Multi-Shot ist der Differentiator, über den Launch-Week-Creator immer wieder posten (venturetwins). Behandeln Sie frühe Outputs als editierbare First Passes, dann verfeinern Sie Prompts Shot für Shot.

Still-Designer, die schon in FLUX leben

Wenn Sie FLUX für Stills kennen, lautet die öffentliche FLUX-3-Story: „gleiche Familie, jetzt Zeit + Sound.“ Stills bleiben auf Image, Motion auf Video.

Was wir wissen vs. was wir nicht wissen

| Wir wissen (sourced) | Wir wissen nicht / behaupten wir nicht | | --- | --- | | Öffentlicher Launch 23. Juli 2026 mit multimodaler Positionierung (@bfl_ai; BFL-Blog) | Dass jeder Host, jede Auflösung oder Dauer-Toggle weltweit identisch ist | | Video-Narrative umfasst ~20s, Multi-Shot, natives Audio (The Decoder) | Garantierte First-Take-Perfektion für jedes Gesicht, jede Hand und jede Full-Body-Drehung | | Frühe Preference-Scores existieren in Launch-Coverage und sind vorläufig (The Decoder) | Unabhängige, peer-reviewed Leaderboards, die ein permanentes „#1 Video Model“ krönen | | FLUX.2 etablierte ein starkes Image-Kapitel (BFL FLUX.2) | Dass Stills und Video bei jedem Seed exakt denselben Aesthetic Fingerprint teilen | | Diese Site stellt Browser-Video- und Image-Generatoren für FLUX-3-Workflows bereit | Cross-Vendor Dollar-pro-Sekunde-Preistabellen (hier nicht verglichen) |

Warum das für Builder zählt

  1. Video + Audio in einer Generation reduziert Tool-Hopping für First-Pass-Ads und Explainer.
  2. Multi-Shot-Prompting ändert, wie Sie Briefings schreiben—schreiben Sie Cuts, nicht nur Vibes (Multi-Shot Early Notes).
  3. FLUX-Markenkontinuität hilft Teams, die schon in FLUX-Still-Sprache prompten, Motion-Arbeit ohne neues Mental Model zu migrieren.
  4. Browser-Try-Pfade schlagen das Warten auf eine perfekte lokale Installation, wenn Sie nur wissen müssen, ob Ihr Product Shot die Motion überlebt.

So evaluieren Sie FLUX 3 selbst auf dieser Site

  1. Öffnen Sie den FLUX 3 Video-Generator.
  2. Fügen Sie Prompt A unten ein (Multi-Shot).
  3. Einmal im Fullscreen ansehen: Gesichter, Cut-Klarheit, Audio-Fit (falls vorhanden) und Crop-Survival für 9:16.
  4. Keeper speichern; optional zweiter Pass mit Image to Video aus einem Still, das Sie schon mögen, auf Image.

Prompt A — Multi-Shot Backyard Joust

Multi-shot short film, 12 seconds, playful daylight backyard.
Shot 1 wide: two kids jousting with bright pool noodles, green grass, summer sun.
Shot 2 medium: slow motion near-miss as noodles clash, fabric and hair motion clear.
Shot 3 close-up: both kids laughing, natural faces, soft bokeh fence in background.
Natural ambient audio feel, no music bed, no text overlays, no watermark.

Prompt B — Product Hero Spin

Product commercial, 8 seconds, clean studio.
Shot 1: matte black wireless earbuds case on white seamless, soft key light.
Shot 2: lid opens smoothly, earbuds catch a specular highlight.
Shot 3: earbud floats closer to camera, macro detail on mesh.
Subtle whoosh SFX energy, no logos other than the product shape, no watermark.

Prompt C — Rainy Neon Street (Mood)

Cinematic street clip, 10 seconds, night rain, neon reflections.
Single continuous push-in toward a woman laughing under a translucent umbrella,
wet asphalt, cyan and magenta signs, handheld micro-motion, natural skin texture.
City ambience and light rain SFX, no dialogue, no on-screen text, no watermark.

Was als Nächstes beobachten

FAQ

Was ist FLUX 3?

FLUX 3 ist das multimodale Foundation-Modell von Black Forest Labs vom 23. Juli 2026 für Image, Video, Audio und Action-Prediction, gemeinsam trainiert statt als getrennte Single-Purpose-Modelle (BFL-Blog; Launch-Thread).

Ist FLUX 3 nur ein Video-Modell?

Nein. Öffentliche Materialien beschreiben Video-, Image-, Audio- und Action-Pfade unter einem multimodalen Design (BFL-Modelle). Auf dieser Site starten Sie mit Video oder Image.

Wie lang können FLUX-3-Videos sein?

Launch-Reporting nennt Clips bis etwa 20 Sekunden in BFLs öffentlicher Narrative (The Decoder). Bestätigen Sie immer die Duration-Control in der Generator-UI für Ihren Run.

Unterstützt FLUX 3 Multi-Shot in einem Prompt?

Ja—das ist ein Launch-Week-Creator-Highlight: mehrere Shots aus einem einzelnen Prompt (venturetwins). Schreiben Sie explizite Shot-1- / Shot-2- / Shot-3-Zeilen für beste Kontrolle.

Was ist natives Audio in FLUX 3?

Natives Audio heißt: das Modell kann Sound mit dem Video erzeugen—Atmosphäre, SFX und dialogorientierte Demos tauchen in der öffentlichen Coverage auf (The Decoder; BFL Launch).

Wie unterscheidet sich FLUX 3 von FLUX.2?

FLUX.2 (Nov 2025) ist das produktionsreife Kapitel Image Generation & Editing (BFL FLUX.2). FLUX 3 erweitert die Familie zu einem multimodalen Stack mit first-class Video + Audio-Storytelling (BFL FLUX 3).

Kann ich FLUX 3 kostenlos online testen?

Ja. Öffnen Sie den FLUX 3 Video-Generator auf flux3.video und starten Sie kostenlos—keine Karte nötig zum Beginnen. Stills: Image-Generator.

Text to Video oder Image to Video—was zuerst?

Nutzen Sie Text to Video, wenn Sie eine Szene von Grund auf erfinden. Nutzen Sie Image to Video, wenn Sie schon ein Produktfoto oder Character-Still haben, das Sie animieren wollen—beides lebt unter Video.

Sind die veröffentlichten Win-Rate-Vergleiche final?

Nein. Frühe Preference-Rates in Launch-Artikeln sind vorläufige vendor-reported Signals unter spezifischen Testbedingungen (The Decoder). Fahren Sie Ihre eigenen Prompts für Entscheidungen, die zählen.

Wo sollte ich jetzt starten?

Fügen Sie Prompt A in den Video-Generator ein, schauen Sie einmal Fullscreen, dann iterieren Sie Shot-Beschreibungen—nicht nur Adjektive.

Über Avery Lin

Avery Lin ist AI-Model-Release-Analyst und verfolgt FLUX-Family-Launches—und übersetzt öffentliche Modell-Fakten in klare Try-Pfade für Creator auf FLUX 3.

More Posts