50% OFF por tempo limitado!Pegar oferta

LTX 2.5 vs FLUX 3: pesos abertos ou vídeo no navegador?

Автор Avery Lin · Опубликовано 2026-08-13 flux-3flux3ltx-2-5ltxmodel-vs-modelrelease-watchai-videotext-to-videomulti-shotopen-weightsblack-forest-labslightricks
LTX 2.5 vs FLUX 3: pesos abertos ou vídeo no navegador?

Tratar LTX 2.5 e FLUX 3 como a mesma “nova caixa de vídeo” é como times perdem uma semana em grafos Comfy—ou queimam créditos hospedados num job que de fato precisava de pesos locais. Um stack é um world model de pesos abertos que você baixa, faz fine-tune e roda em hardware que controla. O outro é um modelo multimodal da família FLUX que você pode experimentar hoje no navegador neste site.

O LTX 2.5 (também escrito LTX-2.5) é o lançamento de agosto de 2026 de vídeo e world model com pesos abertos da LTX, a empresa de open world models desmembrada da Lightricks. A copy oficial de produto enfatiza multi-shot nativo em um passe, aderência mais forte ao prompt, um novo decoder de vídeo diffusion, previsão automática de duração e pesos que você pode fine-tunar e auto-hospedar (página de modelo LTX 2.5; card do Hugging Face; VentureBeat, 11 de agosto de 2026).

O FLUX 3 da Black Forest Labs é um modelo de fundação multimodal treinado em conjunto em imagens, vídeo e áudio. A história pública de vídeo: clips de até cerca de 20 seconds, multi-shot a partir de um prompt e áudio nativo, mais uma superfície de imagem na mesma família (blog da BFL; FLUX 3 Video, parte 1; página de modelos FLUX 3; The Decoder).

Isto é um mapa de decisão, não uma coroa eterna de #1. Você sai com uma tabela de 30 segundos de eixos públicos, regras se/então por cenário e três prompts para copiar e colar para rodar na nossa página de vídeo FLUX 3. O flux3.video não gera LTX 2.5. Para o mapa de lançamento do FLUX 3, comece por O que é o FLUX 3?; para a linguagem de planos, use FLUX 3 Video: multi-shot, clips ~20 s e áudio nativo. Critérios do campo de pares estão em FLUX 3 vs modelos de vídeo de IA pares—este artigo não reabre esse ranking.

TLDR

  • LTX 2.5 (janela de lançamento público 11 de agosto de 2026): world model / áudio-vídeo de pesos abertos classe 22B; multi-shot nativo em um passe; checkpoints para baixar e workflows oficiais do ComfyUI; licença comunitária apresentada como uso livre abaixo de $10M ARR (página de modelo LTX; Hugging Face; VentureBeat).
  • FLUX 3 (lançamento público 23 de julho de 2026): backbone multimodal imagem + vídeo + áudio; narrativa pública de vídeo ≈ 20 seconds + multi-shot + áudio nativo; caminho de teste hospedado neste site (blog da BFL; FLUX 3 Video).
  • Regra de decisão: precisa de pesos abertos auto-hospedados, fine-tunes ou workflows audio-condicionados / de grafo de nós → LTX 2.5 no caminho oficial LTX / Comfy. Precisa de um clip da mesma geração no navegador, hojeFLUX 3 em flux3.video.
  • Neste site: o vídeo padrão é FLUX 3. Não há gerador de LTX 2.5. Os créditos iniciais de cadastro são 10 credits; o passo padrão draft-720p × 5s custa 25 credits—esses créditos iniciais não fecham um vídeo padrão.

Pontos principais

  1. A cisão é implantação, não um concurso de beleza. O pitch oficial do LTX 2.5 é uma fundação que você pode baixar, fine-tunar e rodar no seu hardware (LTX 2.5; card HF). O pitch público do FLUX 3 é um gerador multimodal com uma superfície de produto hospedada que você abre numa aba (BFL; o gerador de vídeo deste site).
  2. Os dois agora vendem multi-shot nativo. O Hugging Face afirma que versões anteriores do LTX-2 produziam um único plano contínuo; o 2.5 gera cenas conectadas em um passe que mantêm identidade, luz e voz entre cortes (HF “What’s new”). Materiais de lançamento do FLUX 3 já enfatizavam multi-shot a partir de um prompt (BFL; notas de Justine Moore / a16z).
  3. Áudio sincronizado é mesa nas duas histórias oficiais. O LTX-2.5 mantém geração conjunta áudio-vídeo e envia um VAE de áudio dedicado (HF; tutorial ComfyUI). O FLUX 3 gera áudio nativo opcional com os frames: diálogo multilíngue, SFX e ambiência (modelos BFL; FLUX 3 Video). Ouça cada take.
  4. Narrativas de duração não são o mesmo knob. A cobertura pública do FLUX 3 centra-se em até ~20 seconds em uma geração em HD, FHD via upscaling (BFL; FLUX 3 Video). O LTX 2.5 documenta um preditor de duração opcional que define o comprimento a partir do prompt em vez de um parâmetro fixo (HF). Trate “quantos segundos você recebe” como específico do host e do grafo.
  5. Gráficos de velocidade / preferência do fornecedor não são ranking. Materiais de lançamento da LTX incluem a figura self-hosted de 6.8s para um clip 10s 720p em 2× GB200 e números preliminares no estilo preferência que colocam o FLUX 3 bem atrás do LTX 2.5. São medidos pelo fornecedor / preliminares—deixe isso em O que não sabemos (FAQ da LTX; VentureBeat).
  6. Avaliação com o mesmo prompt numa superfície hospedada ainda supera coroas abstratas para anúncios. Rode os prompts abaixo no FLUX 3 vídeo (stills em imagem; previews baratos em Draft Mode).

Head-to-head: eixos públicos (não é ranking)

Leia esta tabela em 30 segundos. As células são posicionamento público / features documentadas, não scores de lab.

| Eixo (sua tarefa) | LTX 2.5 (LTX / Lightricks) | FLUX 3 (Black Forest Labs) | | --- | --- | --- | | Pitch público principal | World model de pesos abertos: baixar, fine-tunar, auto-hospedar; multi-shot nativo; decoder orientado a cinema (LTX) | Inteligência visual multimodal: imagem + vídeo + áudio (+ caminho de ação) em uma arquitetura (BFL) | | Janela oficial / pública | Cobertura de lançamento 11 de agosto de 2026 (VentureBeat; índice do blog LTX) | 23 de julho de 2026 (@bfl_ai; blog da BFL) | | Pesos / licença (público) | Pesos abertos no Hugging Face; LTX-2.x Community License; copy oficial: uso comercial livre abaixo de $10M ARR, sem branding obrigatório (HF; FAQ da LTX) | Narrativa hosted / API / pesos privados no lançamento; open-weight FLUX 3 Dev descrito como passo posterior do rollout, não “baixar hoje” (BFL; VentureBeat FLUX 3) | | Multi-shot / multi-corte | Cenas conectadas nativas em um passe—a manchete 2.5 vs o LTX-2 de plano único (HF; ComfyUI) | Narrativa forte de lançamento: vários planos a partir de um prompt; encadeamento agentic em sequências mais longas (BFL; venturetwins) | | Áudio nativo / sincronizado | Geração AV conjunta; VAE de áudio + vocoder no pacote partido; prompt de sons e diálogo (HF; ComfyUI) | Áudio nativo opcional com os frames: fala multilíngue, SFX, ambiência (modelos BFL; FLUX 3 Video) | | Superfície de entrada / controle (pública) | Text-to-video, image-to-video, first-last-frame (FLF2V) nos templates oficiais do Comfy; tags HF também listam caminhos de condicionamento de vídeo e áudio (ComfyUI; HF) | Text-to-video, image-to-video, video-to-video, keyframe, continuation generativa (BFL; FLUX 3 Video) | | Narrativa de duração | Um preditor de duração opcional define a contagem de frames a partir do prompt; não assuma um máximo publicado para cada grafo (HF) | Até ~20 seconds em uma geração, HD; FHD via upscaling (BFL; FLUX 3 Video) | | Sibling still / imagem | A família LTX é AV / world-model primeiro; stills são entradas (I2V / FLF2V), não a manchete de produto | Caminho explícito FLUX 3 Image na mesma família multimodal (BFL; teste stills em imagem) | | Caminho de teste | Oficial: página de modelo ltx.io, pesos, docs ComfyUI, repo GitHub LTX-2 (pipelines 2.5 vivem na árvore LTX-2) | Caminho hospedado free-start em FLUX 3 vídeo + imagem + Draft Mode |

Como usar a tabela: se o gargalo for pesos, LoRA, on-prem ou um grafo audio-to-video, pese a coluna LTX. Se o gargalo for abrir uma aba e julgar um take multi-shot nesta tarde, pese a coluna FLUX 3 + este site.

Still editorial de comparação dual-panel — LTX 2.5 vs FLUX 3

Pesos abertos ou um caminho de teste no navegador · frame editorial de capa desta comparação · gerado para o blog do FLUX 3

Família / timeline (duas linhas, não uma família)

| Data | Evento | Fonte | | --- | --- | --- | | 2025-10-23 | LTX-2 anunciado como modelo de fundação áudio-vídeo unificado (linhagem—não 2.5) | notas de lançamento LTX | | 2026-07-23 | Lançamento multimodal público do FLUX 3; narrativa early access de vídeo + áudio | blog da BFL; @bfl_ai | | 2026-08-04 | BFL publica notas de geração do FLUX 3 Video (≤20s, HD, áudio nativo) | FLUX 3 Video, parte 1 | | 2026-08-11 | Lançamento de pesos abertos do LTX 2.5 + templates ComfyUI do primeiro dia | VentureBeat; ComfyUI; HF |

Estes não são a mesma família de produto. Vocabulário compartilhado (“áudio nativo”, “multi-shot”) não implica estética, licenças ou knobs de duração idênticos. Não confunda LTX-2 (o modelo AV unificado anterior e o nome do repo no GitHub) com LTX 2.5 (o lançamento nativo multi-shot de agosto de 2026).

Still editorial — caminho de auto-hospedagem / pesos abertos, rotulado LTX 2.5

Caminho de auto-hospedar e fine-tunar · frame editorial · gerado para o blog do FLUX 3 · não é captura do software LTX

Still editorial — caminho do gerador no navegador, rotulado FLUX 3

Caminho de teste no navegador neste produto · frame editorial · gerado para o blog do FLUX 3 · não é captura ao vivo do produto

Vencedores por cenário (se / então)

1. Você precisa dos pesos numa máquina que controla

Se o trabalho jurídico, de marca ou de robótica exige checkpoints locais, LoRA ou inferência on-prem, então o LTX 2.5 é o eixo que esses materiais oficiais anunciam: pesos abertos, uma base pretrained feita para fine-tune e arquivos partidos alinhados ao Comfy (LTX; HF; GitHub LTX-2).
Neste site: nós não hospedamos esses pesos. Use o FLUX 3 só para estressar a linguagem do prompt (beats, freeze de guarda-roupa, intenção de áudio) em vídeo antes de investir numa instalação local.

2. Você quer um clip da mesma geração no navegador nesta tarde

Se o job é um anúncio UGC, um product spin ou um beat de diálogo e você vai julgar keepers você mesmo, então comece na superfície FLUX 3 hospedada que já está no ar aqui. A história pública da BFL encaixa nesse loop: multi-shot + ~20 seconds + áudio nativo (BFL).
Neste site: abra o FLUX 3 vídeo. Aquecimento opcional no Draft Mode.

3. Áudio é uma entrada, não só trilha

Se você já tem uma cama de voz ou um motivo sonoro que deve dirigir a imagem (audio-to-video / grafos audio-condicionados), então pese as tags de entrada de áudio documentadas do LTX 2.5 e o guia oficial do Comfy “descreva sons e diálogo” (HF; ComfyUI; guia de prompt LTX 2.5).
Neste site: o FLUX 3 pode emitir áudio nativo com os frames (modelos BFL)—isso não é o mesmo que enviar um stem para conduzir o corte. O Prompt B abaixo ainda deixa você ouvir se a energia da fala sobrevive a um take hospedado.

4. Still travado → motion (packaging já aprovado)

Se o hero frame está assinado, então os dois stacks documentam image-to-video. A LTX envia templates oficiais I2V e first-last-frame (ComfyUI). A família FLUX 3 inclui uma superfície de imagem mais i2v (BFL).
Neste site: congele o still em imagem e depois anime em vídeo.

5. Draft barato, depois gaste num keeper

Se você está explorando linguagem de planos, então não salte para um clip 1080p longo hospedado. Neste produto o padrão é draft-720p × 5s = 25 credits. Contas novas recebem 10 credits iniciais, que não conseguem terminar esse vídeo padrão—use stills primeiro, recarregue ou encurte o brief. Passos honestos de free-start: Como usar o FLUX 3 grátis.

O que sabemos vs. o que não sabemos

| Sabemos (com fonte) | Não sabemos / não afirmamos | | --- | --- | | Janela pública do LTX 2.5 2026-08-11; pesos abertos + multi-shot nativo + AV conjunto (VentureBeat; LTX; HF) | Que o LTX 2.5 é “o melhor oficial” ou um #1 permanente sobre o FLUX 3 | | Lançamento público do FLUX 3 2026-07-23; multimodal; ~20 seconds + áudio nativo (BFL; The Decoder) | Que cada host expõe knobs idênticos de duração, resolução ou créditos | | A FAQ oficial da LTX cita 6.8s para um clip 10s 720p self-hosted em 2× GB200; o tempo de API gerenciada no mesmo pacote de lançamento é mais lento (FAQ da LTX; VentureBeat) | Que um grafo Comfy no laptop, ou qualquer revendedor hospedado, vai bater 6.8s | | Materiais do fornecedor mencionam 4K HDR / RAW e a copy do Comfy menciona up to 50 FPS (FAQ da LTX; ComfyUI) | Que seu primeiro export self-host é 4K / 50 FPS, ou que este site sai nessas specs | | Números de preferência encomendados pela LTX na cobertura de lançamento colocam o LTX 2.5 à frente do FLUX 3 e são rotulados como preliminares (VentureBeat) | Leaderboards independentes peer-reviewed entre labs que fechem o par | | Este produto expõe FLUX 3 vídeo hospedado; draft padrão 5s ≈ 25 credits; os 10 credits iniciais não conseguem terminá-lo | Tabelas de shopping dólar-por-segundo cross-channel (não comparadas aqui) | | Nenhuma ferramenta LTX / LTX 2.5 em flux3.video | Que este site vai adicionar geração LTX 2.5 em um clique |

Como avaliar no FLUX 3 (protocolo de mesmo prompt)

Use isto quando precisar de uma leitura hospedada da linguagem de planos—não como substituto de uma instalação local do LTX 2.5.

  1. Abra nossa página de vídeo FLUX 3 (aquecimento opcional no Draft Mode).
  2. Confira a estimativa de créditos na tela. O padrão draft-720p × 5s é 25 credits. Os 10 credits iniciais não completam esse run—encurte, use um still ou adicione créditos primeiro (Como usar o FLUX 3 grátis).
  3. Rode Prompt A, B e C abaixo sem alteração (ou só troque nomes de produto / linhas de freeze de guarda-roupa de que realmente precise).
  4. Pontue cada take 0–2 em: clareza de cortes, identidade do sujeito, realismo de motion, encaixe de áudio, sobrevivência do crop (9:16 ou 16:9 conforme escrito).
  5. Mantenha qualquer clip ≥7/10; reescreva só a linha do plano que falha.
  6. Opcional: trave um still em imagem e depois image-to-video o mesmo brief.

Prompt A — multi-shot social UGC

Vertical 9:16 UGC ad, about 10 seconds, daylight kitchen.
Shot 1 wide: young adult in a rust-orange cardigan pours sparkling water into a tall glass, casual phone-tripod energy.
Shot 2 medium: glass fills, bubbles rise, condensation visible, same cardigan and subway-tile backsplash.
Shot 3 close-up: satisfied sip, natural smile, soft window light, no logos.
Natural kitchen ambience and fizz SFX, no music bed, no captions, no watermark.

Prompt B — dialogue explainer beat

Horizontal 16:9 product explainer, about 8 seconds, quiet loft studio.
Medium shot: presenter in a slate linen shirt speaks to camera,
holds a matte charcoal water bottle, clear enunciation, natural hand gestures.
Background: blurred brick and a single plant, soft daylight.
Native dialogue energy: short line about "all-day cold," ambient room tone only, no music, no on-screen text, no watermark.

Prompt C — still-to-motion product hero

Product commercial, about 8 seconds, 16:9, softbox studio.
Start from a locked hero still of a matte charcoal water bottle on pale stone.
Slow push-in as a single water bead rolls down the side; realistic weight and reflection;
a hand enters and lifts the bottle—fingers and metal contact stay solid.
Soft room tone only, no music, no logos, no watermark.

Regra de decisão (uma frase)

Escolha o caminho oficial do LTX 2.5 quando precisar de pesos abertos para baixar, auto-hospedagem / fine-tune ou um workflow de grafo de nós audio-condicionado (LTX; HF; ComfyUI).

Escolha o FLUX 3 neste site quando quiser um caminho de teste multi-shot + áudio nativo no navegador na janela de lançamento do LTX 2.5 e for julgar keepers você mesmo no nosso gerador de vídeo (stills: imagem; loops rápidos: Draft Mode). Isto não é um campeonato em duplo-cego.

FAQ

O LTX 2.5 é “melhor” que o FLUX 3?

Não como ranking universal. Materiais públicos mostram linguagem de craft que se sobrepõe (multi-shot, áudio sincronizado) e jobs diferentes (pesos abertos / auto-hospedagem vs caminho de teste multimodal hospedado). Melhor = encaixa no eixo que você de fato tem, depois de um teste com o mesmo prompt—não um gráfico de fornecedor.

Posso gerar LTX 2.5 no flux3.video?

Não. O modelo de vídeo padrão deste site é FLUX 3. Aqui não há gerador nem botão de LTX 2.5. Caminhos oficiais da LTX: página de modelo, pesos, ComfyUI.

O que de fato é novo no LTX 2.5 versus o LTX-2?

Card 2.5 do Hugging Face: multishot nativo (versões anteriores = um plano contínuo), um novo decoder de vídeo diffusion, encoder de texto Gemma 4 12B, prompt enhancer, preditor de duração opcional e um checkpoint destilado melhorado (HF). LTX-2 continua o nome de repo / linhagem no GitHub.

O FLUX 3 já tem pesos abertos para baixar?

Não como história de manchete “baixar hoje”. A cobertura de lançamento descreve early access / API / pesos privados, com FLUX 3 Dev apontado como passo open-weight planejado no rollout (BFL). Isso é um fato diferente dos checkpoints já públicos do LTX 2.5.

Quanto tempo cada modelo pode gerar em um passe?

Materiais públicos do FLUX 3: até cerca de 20 seconds (BFL; FLUX 3 Video). O LTX 2.5 enfatiza duração automática a partir do prompt em vez de um máximo público fixo (HF). Limites de host e grafo ainda cortam o que você vê.

Ambos os modelos geram áudio de forma nativa?

Sim nas histórias de produto públicas (LTX / HF; modelos BFL). Áudio nativo ≠ cama musical automática nem lipsync no primeiro take. Use fones.

Devo acreditar nas claims de 4K / 50 FPS / 6.8s?

Trate-as como declaradas pelo fornecedor, específicas de hardware. O número 6.8s é uma figura self-host de 2× GB200, 720p, clip 10s (FAQ da LTX). 4K HDR / 50 FPS aparecem na copy oficial LTX / Comfy (LTX; ComfyUI)—nós não afirmamos que seu primeiro export, ou este site, vai batê-las.

Quantos créditos preciso para um primeiro clip FLUX 3 aqui?

Padrão draft-720p × 5s ≈ 25 credits. Contas novas recebem 10 credits iniciais, que não conseguem terminar esse run padrão. Leia a estimativa na barra de envio. Stills em imagem costumam custar menos por tentativa.

Quando começar de um still em vez de texto puro?

Quando packaging, semelhança facial ou layout já estiver aprovado. Gere o still em imagem e depois anime em vídeo. Os templates oficiais I2V / FLF2V da LTX são o movimento paralelo nesse stack (ComfyUI).

O flux3.video é oficial da Black Forest Labs?

Não. O flux3.video é um produto independente que oferece geração no navegador com a marca FLUX 3. A pesquisa oficial vive em bfl.ai. Seu caminho de teste aqui é vídeo e imagem.

Devo comparar preços entre plataformas aqui?

Não. Este artigo evita de propósito tabelas de shopping $/segundo cross-channel. Decida por encaixe da tarefa e taxa de keepers, e depois precifique na superfície de onde você realmente envia.

Sobre Avery Lin

Avery Lin é analista de lançamentos de modelos de IA que acompanha releases da família FLUX e transforma fatos públicos de modelos em caminhos de teste claros para creators no FLUX 3.

More Posts