Tratar LTX 2.5 y FLUX 3 como la misma «nueva caja de vídeo» es cómo los equipos pierden una semana en grafos Comfy—o queman créditos alojados en un trabajo que de verdad necesitaba pesos locales. Un stack es un world model de pesos abiertos que descargas, haces fine-tune y ejecutas en hardware que controlas. El otro es un modelo multimodal de la familia FLUX que puedes probar hoy en el navegador en este sitio.
LTX 2.5 (también escrito LTX-2.5) es el lanzamiento de agosto de 2026 de vídeo y world model con pesos abiertos de LTX, la compañía de open world models escindida de Lightricks. La copy oficial de producto insiste en multi-shot nativo en un solo pase, mayor adherencia al prompt, un nuevo decodificador de vídeo diffusion, predicción automática de duración y pesos que puedes fine-tunear y autoalojar (página de modelo LTX 2.5; ficha de Hugging Face; VentureBeat, 11 de agosto de 2026).
FLUX 3 de Black Forest Labs es un modelo de fundación multimodal entrenado de forma conjunta en imágenes, vídeo y audio. La historia pública de vídeo: clips de hasta unos 20 seconds, multi-shot desde un prompt y audio nativo, más una superficie de imagen en la misma familia (blog de BFL; FLUX 3 Video, parte 1; página de modelos FLUX 3; The Decoder).
Esto es un mapa de decisión, no una corona eterna del #1. Te irás con una tabla de 30 segundos de ejes públicos, reglas if/then por escenario y tres prompts para copiar y pegar para correr en nuestra página de vídeo FLUX 3. flux3.video no genera LTX 2.5. Para el mapa de lanzamiento de FLUX 3, empieza por ¿Qué es FLUX 3?; para el lenguaje de planos, usa FLUX 3 Video: multi-shot, clips ~20 s y audio nativo. Los criterios del campo de pares viven en FLUX 3 vs modelos de vídeo IA pares—este artículo no reabre ese ranking.
TLDR
- LTX 2.5 (ventana de lanzamiento público 11 de agosto de 2026): world model / audio-vídeo de pesos abiertos de clase 22B; multi-shot nativo en un pase; checkpoints descargables y workflows de ComfyUI oficiales; licencia comunitaria enmarcada como uso libre bajo $10M ARR (página de modelo LTX; Hugging Face; VentureBeat).
- FLUX 3 (lanzamiento público 23 de julio de 2026): backbone multimodal imagen + vídeo + audio; narrativa pública de vídeo ≈ 20 seconds + multi-shot + audio nativo; ruta de prueba alojada en este sitio (blog de BFL; FLUX 3 Video).
- Regla de decisión: necesitas pesos abiertos autoalojados, fine-tunes o workflows audio-condicionados / de grafo de nodos → LTX 2.5 en la ruta oficial LTX / Comfy. Necesitas un clip de la misma generación en el navegador, hoy → FLUX 3 en flux3.video.
- En este sitio: el vídeo por defecto es FLUX 3. No hay generador de LTX 2.5. Los créditos de arranque al registrarse son 10 credits; el paso por defecto draft-720p × 5s cuesta 25 credits—esos créditos de arranque no alcanzan para un vídeo por defecto.
Puntos clave
- La grieta es el despliegue, no un concurso de belleza. El pitch oficial de LTX 2.5 es una fundación que puedes descargar, fine-tunear y ejecutar en tu hardware (LTX 2.5; ficha HF). El pitch público de FLUX 3 es un generador multimodal con una superficie de producto alojada que abres en una pestaña (BFL; el generador de vídeo de este sitio).
- Ambos venden ahora multi-shot nativo. Hugging Face afirma que las versiones anteriores de LTX-2 producían un único plano continuo; 2.5 genera escenas conectadas en un pase que mantienen identidad, luz y voz entre cortes (HF «What’s new»). Los materiales de lanzamiento de FLUX 3 ya insistían en multi-shot desde un prompt (BFL; notas de Justine Moore / a16z).
- El audio sincronizado es table stakes en ambas historias oficiales. LTX-2.5 mantiene la generación conjunta audio-vídeo y envía un VAE de audio dedicado (HF; tutorial de ComfyUI). FLUX 3 genera audio nativo opcional con los fotogramas: diálogo multilingüe, SFX y ambiente (modelos BFL; FLUX 3 Video). Escucha cada take.
- Las narrativas de duración no son la misma perilla. La cobertura pública de FLUX 3 se centra en hasta ~20 seconds en una generación en HD, FHD vía upscaling (BFL; FLUX 3 Video). LTX 2.5 documenta un predictor de duración opcional que fija la longitud desde el prompt en lugar de un parámetro fijo (HF). Trata «cuántos segundos tú obtienes» como específico del host y del grafo.
- Los gráficos de velocidad / preferencia del vendor no son un ranking. Los materiales de lanzamiento de LTX incluyen una cifra self-hosted de 6.8s para un clip 10s 720p en 2× GB200 y números preliminares de estilo preferencia que colocan a FLUX 3 muy por detrás de LTX 2.5. Son medidos por el vendor / preliminares—apárcalos en Lo que no sabemos (FAQ de LTX; VentureBeat).
- La evaluación same-prompt en una sola superficie alojada sigue ganando a las coronas abstractas para enviar anuncios. Corre los prompts de abajo en FLUX 3 vídeo (stills en imagen; previews baratos en Draft Mode).
Cara a cara: ejes públicos (no un ranking)
Lee esta tabla en 30 segundos. Las celdas son posicionamiento público / features documentadas, no scores de lab.
| Eje (tu trabajo) | LTX 2.5 (LTX / Lightricks) | FLUX 3 (Black Forest Labs) | | --- | --- | --- | | Pitch público principal | World model de pesos abiertos: descargar, fine-tunear, autoalojar; multi-shot nativo; decodificador orientado a cine (LTX) | Inteligencia visual multimodal: imagen + vídeo + audio (+ ruta de acción) en una arquitectura (BFL) | | Ventana oficial / pública | Cobertura de lanzamiento 11 de agosto de 2026 (VentureBeat; índice del blog LTX) | 23 de julio de 2026 (@bfl_ai; blog de BFL) | | Pesos / licencia (público) | Pesos abiertos en Hugging Face; LTX-2.x Community License; copy oficial: uso comercial libre bajo $10M ARR, sin branding obligatorio (HF; FAQ de LTX) | Narrativa hosted / API / pesos privados en el lanzamiento; open-weight FLUX 3 Dev descrito como un paso de rollout posterior, no «descargar hoy» (BFL; VentureBeat FLUX 3) | | Multi-shot / multi-corte | Escenas conectadas nativas en un pase—el titular 2.5 frente al LTX-2 de un solo plano (HF; ComfyUI) | Fuerte narrativa de lanzamiento: varios planos desde un prompt; encadenado agentic hacia secuencias más largas (BFL; venturetwins) | | Audio nativo / sincronizado | Generación AV conjunta; VAE de audio + vocoder en el pack partido; prompt de sonidos y diálogo (HF; ComfyUI) | Audio nativo opcional con los fotogramas: habla multilingüe, SFX, ambiente (modelos BFL; FLUX 3 Video) | | Superficie de entrada / control (pública) | Text-to-video, image-to-video, first-last-frame (FLF2V) en plantillas Comfy oficiales; las etiquetas HF también listan rutas de condicionado de vídeo y audio (ComfyUI; HF) | Text-to-video, image-to-video, video-to-video, keyframe, continuation generativa (BFL; FLUX 3 Video) | | Narrativa de duración | Un predictor de duración opcional fija el recuento de frames desde el prompt; no asumas un máximo publicado para cada grafo (HF) | Hasta ~20 seconds en una generación, HD; FHD vía upscaling (BFL; FLUX 3 Video) | | Sibling still / imagen | La familia LTX es AV / world-model primero; los stills son entradas (I2V / FLF2V), no el titular de producto | Ruta explícita FLUX 3 Image en la misma familia multimodal (BFL; prueba stills en imagen) | | Ruta de prueba | Oficial: página de modelo ltx.io, pesos, docs de ComfyUI, repo GitHub LTX-2 (los pipelines 2.5 viven en el árbol LTX-2) | Ruta alojada free-start en FLUX 3 vídeo + imagen + Draft Mode |
Cómo usar la tabla: si el cuello de botella son pesos, LoRA, on-prem o un grafo audio-to-video, pondera la columna LTX. Si el cuello es abrir una pestaña y juzgar un take multi-shot esta tarde, pondera la columna FLUX 3 + este sitio.

Pesos abiertos o una ruta de prueba en el navegador · frame de cover editorial para esta comparación · generado para el blog de FLUX 3
Familia / timeline (dos líneas, no una familia)
| Fecha | Evento | Fuente | | --- | --- | --- | | 2025-10-23 | LTX-2 anunciado como modelo de fundación audio-vídeo unificado (linaje—no 2.5) | notas de lanzamiento LTX | | 2026-07-23 | Lanzamiento multimodal público de FLUX 3; narrativa early access de vídeo + audio | blog de BFL; @bfl_ai | | 2026-08-04 | BFL publica notas de generación de FLUX 3 Video (≤20s, HD, audio nativo) | FLUX 3 Video, parte 1 | | 2026-08-11 | Lanzamiento de pesos abiertos LTX 2.5 + plantillas ComfyUI del primer día | VentureBeat; ComfyUI; HF |
No son la misma familia de producto. Un vocabulario compartido («audio nativo», «multi-shot») no implica estética, licencias ni perillas de duración idénticas. No confundas LTX-2 (el modelo AV unificado anterior y el nombre del repo de GitHub) con LTX 2.5 (el lanzamiento nativo multi-shot de agosto de 2026).

Ruta de autoalojar y fine-tunear · frame editorial · generado para el blog de FLUX 3 · no es una captura del software LTX

Ruta de prueba en el navegador en este producto · frame editorial · generado para el blog de FLUX 3 · no es una captura de producto en vivo
Ganadores por escenario (if / then)
1. Necesitas los pesos en una máquina que controlas
Si el trabajo legal, de marca o de robótica exige checkpoints locales, LoRA o inferencia on-prem, entonces LTX 2.5 es el eje que esos materiales oficiales anuncian: pesos abiertos, una base pretrained hecha para fine-tune y archivos partidos alineados con Comfy (LTX; HF; GitHub LTX-2).
En este sitio: no alojamos esos pesos. Usa FLUX 3 solo para poner a prueba el lenguaje del prompt (beats, freeze de vestuario, intención de audio) en vídeo antes de invertir en una instalación local.
2. Quieres un clip de la misma generación en el navegador esta tarde
Si el trabajo es un anuncio UGC, un product spin o un beat de diálogo y juzgarás los keepers tú mismo, entonces empieza en la superficie FLUX 3 alojada que ya está viva aquí. La historia pública de BFL encaja en ese bucle: multi-shot + ~20 seconds + audio nativo (BFL).
En este sitio: abre FLUX 3 vídeo. Calentamiento opcional en Draft Mode.
3. El audio es una entrada, no solo una banda sonora
Si ya tienes una cama de voz o un motivo sonoro que debe dirigir la imagen (audio-to-video / grafos audio-condicionados), entonces pondera las etiquetas de entrada de audio documentadas de LTX 2.5 y la guía oficial de Comfy «describe sonidos y diálogo» (HF; ComfyUI; guía de prompt LTX 2.5).
En este sitio: FLUX 3 puede emitir audio nativo con los fotogramas (modelos BFL)—eso no es lo mismo que subir un stem para conducir el corte. El Prompt B de abajo igual te deja oír si la energía del habla sobrevive a un take alojado.
4. Still bloqueado → motion (packaging ya aprobado)
Si el hero frame está firmado, entonces ambos stacks documentan image-to-video. LTX envía plantillas oficiales I2V y first-last-frame (ComfyUI). La familia FLUX 3 incluye una superficie de imagen más i2v (BFL).
En este sitio: congela el still en imagen y luego anima en vídeo.
5. Draft barato, luego gasta en un keeper
Si estás explorando el lenguaje de planos, entonces no saltes a un clip 1080p largo alojado. En este producto el defecto es draft-720p × 5s = 25 credits. Las cuentas nuevas reciben 10 credits de arranque, que no pueden terminar ese vídeo por defecto—usa stills primero, recarga o acorta el brief. Pasos honestos de free-start: Cómo usar FLUX 3 gratis.
Lo que sabemos vs. lo que no sabemos
| Sabemos (con fuente) | No sabemos / no reclamamos | | --- | --- | | Ventana pública de LTX 2.5 2026-08-11; pesos abiertos + multi-shot nativo + AV conjunto (VentureBeat; LTX; HF) | Que LTX 2.5 es «el mejor oficial» o un #1 permanente sobre FLUX 3 | | Lanzamiento público de FLUX 3 2026-07-23; multimodal; ~20 seconds + audio nativo (BFL; The Decoder) | Que cada host exponga perillas idénticas de duración, resolución o créditos | | La FAQ oficial de LTX cita 6.8s para un clip 10s 720p self-hosted en 2× GB200; el tiempo de API gestionada en el mismo paquete de lanzamiento es más lento (FAQ de LTX; VentureBeat) | Que un grafo Comfy en portátil, o cualquier revendedor alojado, igualará 6.8s | | Los materiales del vendor mencionan 4K HDR / RAW y la copy de Comfy menciona up to 50 FPS (FAQ de LTX; ComfyUI) | Que tu primer export self-host es 4K / 50 FPS, o que este sitio saca esas specs | | Números de preferencia encargados por LTX en la cobertura de lanzamiento sitúan a LTX 2.5 por delante de FLUX 3 y se etiquetan como preliminares (VentureBeat) | Leaderboards independientes peer-reviewed entre labs que cierren el par | | Este producto expone FLUX 3 vídeo alojado; draft por defecto 5s ≈ 25 credits; los 10 credits de arranque no pueden terminarlo | Tablas de shopping dólar-por-segundo cross-channel (no se comparan aquí) | | Ninguna herramienta LTX / LTX 2.5 en flux3.video | Que este sitio añadirá generación LTX 2.5 en un clic |
Cómo evaluar en FLUX 3 (protocolo same-prompt)
Úsalo cuando necesites una lectura alojada del lenguaje de planos—no como sustituto de una instalación local de LTX 2.5.
- Abre nuestra página de vídeo FLUX 3 (calentamiento opcional en Draft Mode).
- Revisa la estimación de créditos en pantalla. El defecto draft-720p × 5s es 25 credits. Los 10 credits de arranque no completarán ese run—acorta, usa un still o añade créditos primero (Cómo usar FLUX 3 gratis).
- Corre Prompt A, B y C de abajo sin cambios (o solo cambia nombres de producto / líneas de freeze de vestuario que de verdad necesites).
- Puntúa cada take 0–2 en: claridad de cortes, identidad del sujeto, realismo de motion, encaje de audio, supervivencia del crop (9:16 o 16:9 según lo escrito).
- Conserva cualquier clip ≥7/10; reescribe solo la línea del plano que falla.
- Opcional: bloquea un still en imagen y luego image-to-video el mismo brief.
Prompt A — multi-shot social UGC
Vertical 9:16 UGC ad, about 10 seconds, daylight kitchen.
Shot 1 wide: young adult in a rust-orange cardigan pours sparkling water into a tall glass, casual phone-tripod energy.
Shot 2 medium: glass fills, bubbles rise, condensation visible, same cardigan and subway-tile backsplash.
Shot 3 close-up: satisfied sip, natural smile, soft window light, no logos.
Natural kitchen ambience and fizz SFX, no music bed, no captions, no watermark.
Prompt B — dialogue explainer beat
Horizontal 16:9 product explainer, about 8 seconds, quiet loft studio.
Medium shot: presenter in a slate linen shirt speaks to camera,
holds a matte charcoal water bottle, clear enunciation, natural hand gestures.
Background: blurred brick and a single plant, soft daylight.
Native dialogue energy: short line about "all-day cold," ambient room tone only, no music, no on-screen text, no watermark.
Prompt C — still-to-motion product hero
Product commercial, about 8 seconds, 16:9, softbox studio.
Start from a locked hero still of a matte charcoal water bottle on pale stone.
Slow push-in as a single water bead rolls down the side; realistic weight and reflection;
a hand enters and lifts the bottle—fingers and metal contact stay solid.
Soft room tone only, no music, no logos, no watermark.
Regla de decisión (una frase)
Elige la ruta oficial de LTX 2.5 cuando necesites pesos abiertos descargables, autoalojamiento / fine-tune o un workflow de grafo de nodos audio-condicionado (LTX; HF; ComfyUI).
Elige FLUX 3 en este sitio cuando quieras una ruta de prueba multi-shot + audio nativa en el navegador durante la ventana de lanzamiento de LTX 2.5 y vayas a juzgar los keepers tú mismo en nuestro generador de vídeo (stills: imagen; bucles rápidos: Draft Mode). Esto no es un campeonato a doble ciego.
FAQ
¿Es LTX 2.5 «mejor» que FLUX 3?
No como ranking universal. Los materiales públicos muestran lenguaje de craft que se solapa (multi-shot, audio sincronizado) y trabajos distintos (pesos abiertos / autoalojamiento vs ruta de prueba multimodal alojada). Mejor = encaja en el eje que de verdad tienes, tras una prueba same-prompt—no un gráfico de vendor.
¿Puedo generar LTX 2.5 en flux3.video?
No. El modelo de vídeo por defecto de este sitio es FLUX 3. Aquí no hay generador ni botón de LTX 2.5. Rutas oficiales de LTX: página de modelo, pesos, ComfyUI.
¿Qué hay de nuevo de verdad en LTX 2.5 frente a LTX-2?
Ficha 2.5 de Hugging Face: multishot nativo (versiones anteriores = un plano continuo), un nuevo decodificador de vídeo diffusion, encoder de texto Gemma 4 12B, prompt enhancer, predictor de duración opcional y un checkpoint destilado mejorado (HF). LTX-2 sigue siendo el nombre de repo / linaje en GitHub.
¿FLUX 3 ya tiene pesos abiertos descargables?
No como historia de titular «descargar hoy». La cobertura de lanzamiento describe early access / API / pesos privados, con FLUX 3 Dev señalado como un paso open-weight previsto en el rollout (BFL). Eso es un hecho distinto de los checkpoints ya públicos de LTX 2.5.
¿Cuánto puede generar cada modelo en un pase?
Materiales públicos de FLUX 3: hasta unos 20 seconds (BFL; FLUX 3 Video). LTX 2.5 enfatiza duración automática desde el prompt en lugar de un máximo público fijo (HF). Los límites de host y grafo siguen topeando lo que ves.
¿Ambos modelos generan audio de forma nativa?
Sí en sus historias de producto públicas (LTX / HF; modelos BFL). Audio nativo ≠ cama musical automática ni lipsync al primer take. Usa auriculares.
¿Debo creer las claims de 4K / 50 FPS / 6.8s?
Trátalas como declaradas por el vendor, específicas de hardware. El número 6.8s es una figura self-host de 2× GB200, 720p, clip 10s (FAQ de LTX). 4K HDR / 50 FPS aparecen en la copy oficial de LTX / Comfy (LTX; ComfyUI)—no reclamamos que tu primer export, o este sitio, las alcance.
¿Cuántos créditos necesito para un primer clip FLUX 3 aquí?
Defecto draft-720p × 5s ≈ 25 credits. Las cuentas nuevas reciben 10 credits de arranque, que no pueden terminar ese run por defecto. Lee la estimación en la barra de envío. Los stills en imagen suelen costar menos por intento.
¿Cuándo partir de un still en lugar de texto puro?
Cuando packaging, parecido facial o layout ya esté aprobado. Genera el still en imagen y luego anima en vídeo. Las plantillas oficiales I2V / FLF2V de LTX son el movimiento paralelo en ese stack (ComfyUI).
¿Es flux3.video oficial de Black Forest Labs?
No. flux3.video es un producto independiente que ofrece generación en el navegador con marca FLUX 3. La investigación oficial vive en bfl.ai. Tu ruta de prueba aquí es vídeo e imagen.
¿Debo comparar precios entre plataformas aquí?
No. Este artículo evita a propósito las tablas de shopping $/segundo cross-channel. Decide por encaje de trabajo y tasa de keepers, y luego precio en la superficie desde la que realmente envías.
Sobre Avery Lin
Avery Lin es una analista de lanzamientos de modelos de IA que sigue los releases de la familia FLUX y convierte hechos públicos de modelos en rutas de prueba claras para creadores en FLUX 3.
