LTX 2.5 und FLUX 3 als dieselbe „neue Video-Box“ zu behandeln, ist der Weg, wie Teams eine Woche in Comfy-Graphen verlieren—oder hosted Credits auf einem Job verbrennen, der eigentlich lokale Weights braucht. Ein Stack ist ein Open-Weights-World-Modell, das Sie herunterladen, fine-tunen und auf Hardware unter Ihrer Kontrolle laufen lassen. Der andere ist ein multimodales Modell der FLUX-Familie, das Sie heute im Browser auf dieser Site testen können.
LTX 2.5 (auch LTX-2.5) ist der Open-Weights-Video- und World-Model-Release vom August 2026 von LTX, der Open-World-Model-Firma, die aus Lightricks ausgegründet wurde. Offizielle Product Copy betont natives Multi-Shot in einem Pass, stärkere Prompt-Adherence, einen neuen Diffusion-Video-Decoder, automatische Duration-Prediction und Weights, die Sie fine-tunen und self-hosten können (LTX-2.5-Modellseite; Hugging-Face-Karte; VentureBeat, 11. August 2026).
FLUX 3 von Black Forest Labs ist ein multimodales Foundation-Modell, das gemeinsam über Bilder, Video und Audio trainiert wurde. Die öffentliche Video-Story: Clips bis etwa 20 seconds, Multi-Shot aus einem Prompt und natives Audio, plus eine Image-Oberfläche in derselben Familie (BFL-Blog; FLUX 3 Video, Teil 1; FLUX-3-Modellseite; The Decoder).
Das ist eine Decision Map, keine ewige #1-Krone. Sie gehen mit einer 30-Sekunden-Tabelle öffentlicher Achsen, Szenario-if/then-Regeln und drei Copy-Paste-Prompts für unsere FLUX-3-Video-Seite. flux3.video generiert kein LTX 2.5. Für die FLUX-3-Launch-Map starten Sie mit Was ist FLUX 3?; für Shot-Sprache nutzen Sie FLUX 3 Video: Multi-Shot, ~20s Clips & natives Audio. Peer-Feld-Kriterien stehen in FLUX 3 vs Peer-AI-Video-Modelle—dieser Artikel öffnet dieses Leaderboard nicht erneut.
TLDR
- LTX 2.5 (öffentliches Launch-Fenster 11. August 2026): Open-Weights 22B-Klasse Audio-Video- / World-Modell; natives Multi-Shot in einem Pass; herunterladbare Checkpoints und offizielle ComfyUI-Workflows; Community-Lizenz als freie Nutzung unter $10M ARR gerahmt (LTX-Modellseite; Hugging Face; VentureBeat).
- FLUX 3 (öffentlicher Launch 23. Juli 2026): multimodales Image- + Video- + Audio-Backbone; öffentliche Video-Narrative ≈ 20 seconds + Multi-Shot + natives Audio; hosted Try-Pfad auf dieser Site (BFL-Blog; FLUX 3 Video).
- Entscheidungsregel: brauchen Sie self-hosted Open Weights, Fine-Tunes oder audio-conditioned / Node-Graph-Workflows → LTX 2.5 auf dem offiziellen LTX- / Comfy-Pfad. Brauchen Sie heute einen Browser-Clip derselben Generation → FLUX 3 auf flux3.video.
- Auf dieser Site: Default-Video ist FLUX 3. Es gibt keinen LTX-2.5-Generator. Starter-Credits nach der Anmeldung sind 10 credits; der Default-Lauf draft-720p × 5s kostet 25 credits—diese Starter-Credits reichen nicht für ein Default-Video.
Key Takeaways
- Die Spaltung ist Deployment, kein Beauty Contest. Der offizielle Pitch von LTX 2.5 ist ein Foundation, das Sie herunterladen, fine-tunen und auf Ihrer Hardware laufen lassen (LTX 2.5; HF-Karte). Der öffentliche Pitch von FLUX 3 ist ein multimodaler Generator mit einer hosted Product Surface, die Sie in einem Tab öffnen können (BFL; der Video-Generator dieser Site).
- Beide verkaufen jetzt natives Multi-Shot. Hugging Face stellt fest: frühere LTX-2-Versionen produzierten einen einzelnen kontinuierlichen Shot; 2.5 erzeugt verbundene Szenen in einem Pass, die Identität, Licht und Stimme über Cuts halten (HF „What’s new“). FLUX-3-Launch-Materialien betonten bereits Multi-Shot aus einem Prompt (BFL; Justine Moore / a16z Notes).
- Synced Audio ist Table Stakes in beiden offiziellen Stories. LTX-2.5 behält Joint Audio-Video-Generation und shippt eine dedizierte Audio-VAE (HF; ComfyUI-Tutorial). FLUX 3 erzeugt optionales natives Audio mit den Frames: multilingualer Dialog, SFX und Ambience (BFL-Modelle; FLUX 3 Video). Hören Sie jeden Take.
- Duration-Narratives sind nicht derselbe Knob. Öffentliche FLUX-3-Coverage zentriert auf bis zu ~20 seconds in einer Generation bei HD, FHD via Upscaling (BFL; FLUX 3 Video). LTX 2.5 dokumentiert einen optionalen Duration Predictor, der die Länge aus dem Prompt setzt statt über einen festen Parameter (HF). Behandeln Sie „wie viele Sekunden Sie bekommen“ als host- und graph-spezifisch.
- Vendor-Speed- / Preference-Charts sind kein Ranking. LTX-Launch-Materialien enthalten eine self-hosted 6.8s für einen 10s-720p-Clip auf 2× GB200-Zahl und vorläufige Preference-Style-Zahlen, die FLUX 3 deutlich hinter LTX 2.5 platzieren. Das sind vendor-gemessen / preliminary—parken Sie sie in What We Don’t Know (LTX FAQ; VentureBeat).
- Same-Prompt-Evaluation auf einer hosted Surface schlägt abstrakte Kronen beim Shipping von Ads. Laufen Sie die Prompts unten auf FLUX 3 Video (Stills auf Image; günstige Previews auf Draft Mode).
Head-to-Head: öffentliche Achsen (kein Ranking)
Lesen Sie diese Tabelle in 30 Sekunden. Zellen sind öffentliche Positionierung / dokumentierte Features, keine Lab-Scores.
| Achse (Ihr Job) | LTX 2.5 (LTX / Lightricks) | FLUX 3 (Black Forest Labs) | | --- | --- | --- | | Primärer Public Pitch | Open-Weights-World-Modell: Download, Fine-Tune, Self-Host; natives Multi-Shot; cinema-orientierter Decoder (LTX) | Multimodale visuelle Intelligenz: Image + Video + Audio (+ Action-Pfad) in einer Architektur (BFL) | | Offizielles / öffentliches Fenster | Launch-Coverage 11. August 2026 (VentureBeat; LTX-Blog-Index) | 23. Juli 2026 (@bfl_ai; BFL-Blog) | | Weights / Lizenz (öffentlich) | Open Weights auf Hugging Face; LTX-2.x Community License; offizielle Copy: freie kommerzielle Nutzung unter $10M ARR, kein verpflichtendes Branding (HF; LTX FAQ) | Hosted- / API- / Private-Weights-Narrative beim Launch; Open-Weight FLUX 3 Dev als späterer Rollout-Schritt beschrieben, nicht „heute downloaden“ (BFL; VentureBeat FLUX 3) | | Multi-Shot / Multi-Cut | Native verbundene Szenen in einem Pass—die 2.5-Headline vs. früheres Single-Shot-LTX-2 (HF; ComfyUI) | Starke Launch-Narrative: mehrere Shots aus einem Prompt; agentic Chaining in längere Sequenzen (BFL; venturetwins) | | Natives / synced Audio | Joint-AV-Generation; Audio-VAE + Vocoder im Split-Pack; Sounds und Dialog prompten (HF; ComfyUI) | Optionales natives Audio mit den Frames: multilingual Speech, SFX, Ambience (BFL-Modelle; FLUX 3 Video) | | Input- / Control-Surface (öffentlich) | Text-to-Video, Image-to-Video, First-Last-Frame (FLF2V) in offiziellen Comfy-Templates; HF-Tags listen auch Video- und Audio-Conditioning-Pfade (ComfyUI; HF) | Text-to-Video, Image-to-Video, Video-to-Video, Keyframe, generative Continuation (BFL; FLUX 3 Video) | | Duration-Narrative | Optionaler Duration Predictor setzt die Frame-Zahl aus dem Prompt; nehmen Sie kein veröffentlichtes Max für jeden Graph an (HF) | Bis zu ~20 seconds in einer Generation, HD; FHD via Upscaling (BFL; FLUX 3 Video) | | Still- / Image-Sibling | LTX-Familie ist AV- / World-Model-first; Stills sind Inputs (I2V / FLF2V), nicht die Product-Headline | Expliziter FLUX-3-Image-Pfad in derselben multimodalen Familie (BFL; Stills testen auf Image) | | Try-Pfad | Offiziell: ltx.io-Modellseite, Weights, ComfyUI-Docs, GitHub-LTX-2-Repo (2.5-Pipelines leben im LTX-2-Tree) | Free-Start hosted Pfad auf FLUX 3 Video + Image + Draft Mode |
So nutzen Sie die Tabelle: wenn der Bottleneck Weights, LoRAs, On-Prem oder ein Audio-to-Video-Graph ist, gewichten Sie die LTX-Spalte. Wenn der Bottleneck Tab öffnen und diesen Nachmittag einen Multi-Shot-Take beurteilen ist, gewichten Sie die FLUX-3- + Diese-Site-Spalte.

Open Weights oder ein Browser-Try-Pfad · redaktioneller Cover-Frame für diesen Vergleich · generiert für den FLUX-3-Blog
Familie / Timeline (zwei Linien, nicht eine Familie)
| Datum | Event | Quelle | | --- | --- | --- | | 2025-10-23 | LTX-2 als unified Audio-Video-Foundation-Modell angekündigt (Lineage—nicht 2.5) | LTX Release Notes | | 2026-07-23 | FLUX 3 öffentlicher multimodaler Launch; Video + Audio Early-Access-Narrative | BFL-Blog; @bfl_ai | | 2026-08-04 | BFL veröffentlicht FLUX-3-Video-Generation-Notes (≤20s, HD, natives Audio) | FLUX 3 Video, Teil 1 | | 2026-08-11 | LTX-2.5-Open-Weights-Launch + Day-One-ComfyUI-Templates | VentureBeat; ComfyUI; HF |
Das sind keine derselben Product Family. Gemeinsames Vokabular („natives Audio“, „Multi-Shot“) impliziert keine identische Ästhetik, Lizenzen oder Duration-Knobs. Verwechseln Sie nicht LTX-2 (das frühere unified AV-Modell und der GitHub-Repo-Name) mit LTX 2.5 (der Native-Multishot-Release vom August 2026).

Self-Host- und Fine-Tune-Pfad · redaktioneller Frame · generiert für den FLUX-3-Blog · kein Screenshot von LTX-Software

Browser-Try-Pfad auf diesem Produkt · redaktioneller Frame · generiert für den FLUX-3-Blog · kein Live-Produkt-Screenshot
Scenario Winners (if / then)
1. Sie brauchen Weights auf einer Maschine unter Ihrer Kontrolle
Wenn Legal, Brand oder Robotics-Arbeit lokale Checkpoints, LoRAs oder On-Prem-Inference verlangt, dann ist LTX 2.5 die Achse, die diese offiziellen Materialien bewerben: Open Weights, eine pretrained Base für Fine-Tuning und Comfy-aligned Split-Files (LTX; HF; GitHub LTX-2).
Auf dieser Site: wir hosten diese Weights nicht. Nutzen Sie FLUX 3 nur, um die Prompt-Sprache zu stress-testen (Beats, Wardrobe Freeze, Audio-Intent) auf Video, bevor Sie in eine lokale Installation investieren.
2. Sie wollen diesen Nachmittag einen Clip derselben Generation im Browser
Wenn der Job eine UGC-Ad, ein Product Spin oder ein Dialog-Beat ist und Sie Keeper selbst beurteilen, dann starten Sie auf der hosted FLUX-3-Surface, die hier bereits live ist. BFLs öffentliche Story passt zu diesem Loop: Multi-Shot + ~20 seconds + natives Audio (BFL).
Auf dieser Site: öffnen Sie FLUX 3 Video. Optionaler Warm-up auf Draft Mode.
3. Audio ist ein Input, nicht nur ein Soundtrack
Wenn Sie bereits ein Voice-Bed oder Sound-Motiv haben, das das Bild steuern soll (Audio-to-Video / audio-conditioned Graphs), dann gewichten Sie die dokumentierten Audio-Input-Tags von LTX 2.5 und die offizielle Comfy-Guidance „Sounds und Dialog beschreiben“ (HF; ComfyUI; LTX-2.5-Prompt-Guide).
Auf dieser Site: FLUX 3 kann natives Audio mit den Frames emittieren (BFL-Modelle)—das ist nicht dasselbe wie einen Stem hochzuladen, der den Cut treibt. Prompt B unten lässt Sie trotzdem hören, ob Speech-Energy einen hosted Take überlebt.
4. Gelocktes Still → Motion (Packaging bereits freigegeben)
Wenn der Hero-Frame signiert ist, dann dokumentieren beide Stacks Image-to-Video. LTX shippt offizielle I2V- und First-Last-Frame-Templates (ComfyUI). Die FLUX-3-Familie enthält eine Image-Surface plus i2v (BFL).
Auf dieser Site: Still auf Image einfrieren, dann auf Video animieren.
5. Günstig draften, dann für einen Keeper ausgeben
Wenn Sie Shot-Sprache erkunden, dann springen Sie nicht in einen langen 1080p-hosted-Clip. Auf diesem Produkt ist der Default draft-720p × 5s = 25 credits. Neue Accounts bekommen 10 credits Starter, die dieses Default-Video nicht beenden können—nutzen Sie zuerst Stills, top-up, oder kürzen Sie den Brief. Ehrliche Free-Start-Schritte: FLUX 3 kostenlos nutzen.
What We Know vs. What We Don’t
| Wir wissen (sourced) | Wir wissen nicht / claimen nicht | | --- | --- | | LTX-2.5-öffentliches Fenster 2026-08-11; Open Weights + natives Multi-Shot + Joint AV (VentureBeat; LTX; HF) | Dass LTX 2.5 „das offizielle Beste“ oder ein permanentes #1 über FLUX 3 ist | | FLUX-3-öffentlicher Launch 2026-07-23; multimodal; ~20 seconds + natives Audio (BFL; The Decoder) | Dass jeder Host identische Duration-, Auflösungs- oder Credit-Knobs exponiert | | Offizielle LTX FAQ nennt 6.8s für einen 10s-720p-Clip self-hosted auf 2× GB200; managed API-Zeit im selben Launch-Paket ist langsamer (LTX FAQ; VentureBeat) | Dass ein Laptop-Comfy-Graph oder irgendein hosted Reseller 6.8s trifft | | Vendor-Materialien erwähnen 4K HDR / RAW und Comfy-Copy erwähnt up to 50 FPS (LTX FAQ; ComfyUI) | Dass Ihr erster Self-Host-Export 4K / 50 FPS ist, oder dass diese Site diese Specs ausgibt | | LTX-beauftragte Preference-Style-Zahlen in der Launch-Coverage setzen LTX 2.5 vor FLUX 3 und sind als preliminary gelabelt (VentureBeat) | Unabhängige, peer-reviewed Cross-Lab-Leaderboards, die das Paar klären | | Dieses Produkt exponiert hosted FLUX 3 Video; Default-Draft 5s ≈ 25 credits; Starter 10 credits können ihn nicht beenden | Cross-Channel-Dollar-pro-Sekunde-Shopping-Tabellen (hier nicht verglichen) | | Kein LTX- / LTX-2.5-Tool auf flux3.video | Dass diese Site One-Click-LTX-2.5-Generation hinzufügen wird |
Wie Sie auf FLUX 3 evaluieren (Same-Prompt-Protokoll)
Nutzen Sie das, wenn Sie eine hosted Lesart der Shot-Sprache brauchen—nicht als Ersatz für eine lokale LTX-2.5-Installation.
- Öffnen Sie unsere FLUX-3-Video-Seite (optionaler Warm-up auf Draft Mode).
- Prüfen Sie die On-Screen-Credit-Schätzung. Default draft-720p × 5s ist 25 credits. Starter 10 credits schließen diesen Lauf nicht ab—kürzen, ein Still nutzen oder zuerst Credits nachladen (FLUX 3 kostenlos nutzen).
- Laufen Sie Prompt A, B und C unten unverändert (oder tauschen Sie nur Product Names / Wardrobe-Freeze-Zeilen, die Sie wirklich brauchen).
- Scoren Sie jeden Take 0–2 auf: Cut Clarity, Subject Identity, Motion Realism, Audio Fit, Crop Survival (9:16 oder 16:9 wie geschrieben).
- Behalten Sie jeden Clip ≥7/10; rewrite nur die failing Shot-Line.
- Optional: Still auf Image locken, dann Image-to-Video desselben Briefs.
Prompt A — Multi-Shot Social UGC
Vertical 9:16 UGC ad, about 10 seconds, daylight kitchen.
Shot 1 wide: young adult in a rust-orange cardigan pours sparkling water into a tall glass, casual phone-tripod energy.
Shot 2 medium: glass fills, bubbles rise, condensation visible, same cardigan and subway-tile backsplash.
Shot 3 close-up: satisfied sip, natural smile, soft window light, no logos.
Natural kitchen ambience and fizz SFX, no music bed, no captions, no watermark.
Prompt B — Dialogue Explainer Beat
Horizontal 16:9 product explainer, about 8 seconds, quiet loft studio.
Medium shot: presenter in a slate linen shirt speaks to camera,
holds a matte charcoal water bottle, clear enunciation, natural hand gestures.
Background: blurred brick and a single plant, soft daylight.
Native dialogue energy: short line about "all-day cold," ambient room tone only, no music, no on-screen text, no watermark.
Prompt C — Still-to-Motion Product Hero
Product commercial, about 8 seconds, 16:9, softbox studio.
Start from a locked hero still of a matte charcoal water bottle on pale stone.
Slow push-in as a single water bead rolls down the side; realistic weight and reflection;
a hand enters and lifts the bottle—fingers and metal contact stay solid.
Soft room tone only, no music, no logos, no watermark.
Entscheidungsregel (ein Satz)
Wählen Sie den offiziellen Pfad von LTX 2.5, wenn Sie herunterladbare Open Weights, Self-Host / Fine-Tune oder einen audio-conditioned Node-Graph-Workflow brauchen (LTX; HF; ComfyUI).
Wählen Sie FLUX 3 auf dieser Site, wenn Sie im LTX-2.5-Launch-Fenster einen browser-nativen Multi-Shot- + Audio-Try-Pfad wollen und Keeper selbst beurteilen auf unserem Video-Generator (Stills: Image; schnelle Loops: Draft Mode). Das ist keine Dual-Blind-Meisterschaft.
FAQ
Ist LTX 2.5 „besser“ als FLUX 3?
Nicht als universelles Ranking. Öffentliche Materialien zeigen überlappende Craft-Sprache (Multi-Shot, synced Audio) und unterschiedliche Jobs (Open Weights / Self-Host vs. hosted multimodaler Try-Pfad). Besser = passt zur Achse, die Sie tatsächlich haben, nach einem Same-Prompt-Test—kein Vendor-Chart.
Kann ich LTX 2.5 auf flux3.video generieren?
Nein. Das Default-Video-Modell dieser Site ist FLUX 3. Es gibt hier keinen LTX-2.5-Generator und keinen LTX-Button. Offizielle LTX-Pfade: Modellseite, Weights, ComfyUI.
Was ist in LTX 2.5 gegenüber LTX-2 wirklich neu?
Hugging-Face-2.5-Karte: natives Multishot (frühere Versionen = ein kontinuierlicher Shot), ein neuer Diffusion-Video-Decoder, Gemma 4 12B Text Encoder, Prompt Enhancer, optionaler Duration Predictor und ein verbesserter distilled Checkpoint (HF). LTX-2 bleibt der Repo- / Lineage-Name auf GitHub.
Hat FLUX 3 bereits herunterladbare Open Weights?
Nicht als Headline-Story „heute downloaden“. Launch-Coverage beschreibt Early Access / API / private Weights, mit FLUX 3 Dev als geplantem Open-Weight-Schritt im Rollout (BFL). Das ist ein anderer Fakt als die bereits öffentlichen Checkpoints von LTX 2.5.
Wie lang kann jedes Modell in einem Pass generieren?
Öffentliche FLUX-3-Materialien: bis etwa 20 seconds (BFL; FLUX 3 Video). LTX 2.5 betont Auto Duration aus dem Prompt statt eines festen öffentlichen Max (HF). Host- und Graph-Limits cappen trotzdem, was Sie sehen.
Generieren beide Modelle Audio nativ?
Ja in ihren öffentlichen Product Stories (LTX / HF; BFL-Modelle). Natives Audio ≠ automatisches Music Bed oder First-Take-Lipsync. Headphones nutzen.
Soll ich den 4K- / 50 FPS- / 6.8s-Claims glauben?
Behandeln Sie sie als vendor-stated, hardware-spezifisch. Die 6.8s-Zahl ist eine 2× GB200, 720p, 10s-Clip-Self-Host-Figur (LTX FAQ). 4K HDR / 50 FPS erscheinen in offizieller LTX- / Comfy-Copy (LTX; ComfyUI)—wir claimen nicht, dass Ihr erster Export oder diese Site sie trifft.
Wie viele Credits brauche ich für einen ersten FLUX-3-Clip hier?
Default draft-720p × 5s ≈ 25 credits. Neue Accounts erhalten 10 credits Starter, die diesen Default-Lauf nicht beenden können. Lesen Sie die Schätzung in der Submit-Bar. Stills auf Image kosten meist weniger pro Try.
Wann sollte ich von einem Still statt purem Text starten?
Wenn Packaging, Face Likeness oder Layout bereits freigegeben ist. Das Still auf Image erzeugen, dann auf Video animieren. LTXs offizielle I2V- / FLF2V-Templates sind der parallele Move auf diesem Stack (ComfyUI).
Ist flux3.video offiziell von Black Forest Labs?
Nein. flux3.video ist ein unabhängiges Produkt, das FLUX-3-branded Browser-Generation anbietet. Offizielle Research lebt auf bfl.ai. Ihr Try-Pfad hier ist Video und Image.
Soll ich Preise hier plattformübergreifend vergleichen?
Nein. Dieser Artikel überspringt bewusst Cross-Channel-$/Sekunde-Shopping-Tabellen. Entscheiden Sie nach Job Fit und Keeper Rate, dann preisen Sie auf der Surface, von der Sie tatsächlich shippen.
About Avery Lin
Avery Lin ist AI-Model-Release-Analystin, die FLUX-Familien-Launches trackt und öffentliche Modellfakten in klare Try-Pfade für Creator auf FLUX 3 übersetzt.
