30% OFF por tempo limitado!Pegar oferta

O que é o FLUX 3? Vídeo e imagem multimodais, grátis online

Escrito por Avery Lin · Publicado em 2026-07-24 flux-3flux3black-forest-labsrelease-watchai-videotext-to-videomultimodal
O que é o FLUX 3? Vídeo e imagem multimodais, grátis online

TLDR

O FLUX 3 é o modelo fundacional multimodal da Black Forest Labs de 23 de julho de 2026. Posicionamento oficial: uma arquitetura que aprende de forma conjunta a partir de imagens, vídeo e áudio, com um caminho de predição de ação para parceiros de robótica (blog da BFL; modelos BFL). Os destaques públicos de vídeo incluem clips de até cerca de 20 segundos, sequências multi-shot a partir de um único prompt e áudio nativo (efeitos sonoros, ambiente, diálogo) (resumo do The Decoder dos materiais BFL; notas de acesso antecipado de Justine Moore / a16z). No FLUX 3 (este site), abra o gerador de vídeo ou o gerador de imagem e comece grátis—sem cartão para testar.

Pontos principais

O que de fato foi entregue

1. Um pitch multimodal unificado—não “vídeo parafusado na imagem”

A Black Forest Labs descreve o FLUX 3 como aprendizado conjunto a partir de imagens, vídeo e áudio dentro de uma arquitetura unificada, porque nenhuma modalidade sozinha captura o mundo (blog da BFL; The Decoder). A empresa enquadra isso como progresso rumo à inteligência visual do mundo real—modelos que percebem, predizem e (via parceiros) agem (thread de anúncio BFL).

Cinematic still vibe for FLUX 3 video realism — showcase on FLUX 3

Linguagem de still do cotidiano ao cinematográfico · frame showcase no FLUX 3

2. Vídeo: duração, multi-shot, áudio nativo

Materiais públicos e a cobertura da semana de lançamento enfatizam:

| Capacidade | Afirmação pública | Fontes principais | | --- | --- | --- | | Duração | Clips de vídeo de até cerca de 20 segundos | The Decoder; CryptoBriefing | | Multi-shot | Vários planos / ângulos a partir de um único prompt | Justine Moore (a16z) | | Áudio nativo | Som alinhado ao clip (SFX, ambiente, caminhos de diálogo) | enquadramento de lançamento BFL; The Decoder | | Interfaces | Text-to-video, image-to-video e fluxos de vídeo relacionados na narrativa pública | The Decoder; caminho de produto no gerador de vídeo deste site |

Tabelas de preferência iniciais publicadas na cobertura de lançamento (por exemplo, comparações curtas em 720p vs outros sistemas de vídeo) são sinais iniciais reportados pelo fornecedor, não certificações independentes da indústria do cinema (resumo de gráfico do The Decoder). Use-as como contexto e depois julgue com seus próprios prompts.

Text-to-video keyframe style — desert chase energy · showcase on FLUX 3

Linguagem de movimento orientada ao prompt · keyframe showcase no FLUX 3

3. Caminho de imagem na mesma família

Posts oficiais mostram amostras de FLUX 3 Image e descrevem síntese/edição entre estilos, aspect ratios e resoluções como parte da stack multimodal (amostras PS do thread BFL; blog da BFL). Neste produto, stills ficam no gerador de imagem com FLUX 3 como default de imagem da casa.

4. Ação / robótica (contexto, não o CTA principal para criadores)

A BFL também anunciou o trabalho FLUX-mimic com a Mimic Robotics, incluindo narrativas de testes industriais envolvendo a Audi (post de ação BFL no thread de lançamento; comunicado). Isso importa para a história do “world model”. Para anúncios sociais, demos de produto e curtas, a superfície prática continua sendo a geração de vídeo + imagem.

5. Linha do tempo da série (FLUX → FLUX.2 → FLUX 3)

| Geração | Tema público | Âncora | | --- | --- | --- | | Era FLUX.1 | Onda open/imagem que tornou o FLUX um default para criadores | História da série em BFL / visão geral na Wikipedia | | FLUX.2 | Geração e edição de imagem de produção (multi-referência, maior fidelidade) | blog FLUX.2, 25 nov. 2025 | | FLUX 3 | Backbone multimodal de vídeo + áudio + imagem | blog FLUX 3, 23 de julho de 2026 |

Em profundidade: para quem é o FLUX 3

Marketers de social e UGC

Clips curtos que sustentam rostos, movimento e iluminação do dia a dia—sem contratar um dia inteiro de produção—são os jobs que multi-shot + áudio nativo desbloqueiam. Comece em text to video.

Times de produto e growth

Image-to-video transforma um still de packaging ou um frame hero de produto em um primeiro passe de anúncio em movimento. Use um still limpo e depois anime no mesmo workspace de vídeo.

Cineastas de IA e storyboarders

O multi-shot de um único prompt é o diferencial sobre o qual criadores falam na semana de lançamento (venturetwins). Trate saídas iniciais como primeiros passes editáveis e refine prompts plano a plano.

Designers de still que já vivem no FLUX

Se você conhece o FLUX por stills, a história pública do FLUX 3 é “mesma família, agora tempo + som”. Mantenha stills em imagem e motion em vídeo.

O que sabemos vs. o que não sabemos

| Sabemos (com fonte) | Não sabemos / não afirmamos | | --- | --- | | Lançamento público em 23 de julho de 2026 com posicionamento multimodal (@bfl_ai; blog da BFL) | Que cada host, resolução ou controle de duração seja idêntico em todos os produtos no mundo | | A narrativa de vídeo inclui ~20 s, multi-shot, áudio nativo (The Decoder) | Perfeição garantida no primeiro take para cada rosto, mão e giro de corpo inteiro | | Scores de preferência iniciais existem na cobertura de lançamento e são preliminares (The Decoder) | Rankings independentes peer-reviewed que coroem um “modelo de vídeo #1” permanente | | O FLUX.2 consolidou um capítulo forte de imagem (BFL FLUX.2) | Que stills e vídeo sempre compartilhem a mesma impressão estética em cada seed | | Este site expõe geradores no navegador de vídeo e imagem para fluxos FLUX 3 | Tabelas de preço dólar-por-segundo entre vendors (não comparadas aqui) |

Por que isso importa para builders

  1. Vídeo + áudio em uma geração reduz o hop entre ferramentas em primeiros passes de anúncios e explainers.
  2. O prompting multi-shot muda como você escreve briefs—escreva cortes, não só vibes (notas multi-shot antecipadas).
  3. A continuidade da marca FLUX ajuda times que já prompteiam em linguagem de stills FLUX a migrar motion sem um modelo mental novo.
  4. Caminhos de teste no navegador vencem a espera por uma install local perfeita quando você só precisa saber se o seu plano de produto sobrevive ao movimento.

Como avaliar o FLUX 3 você mesmo neste site

  1. Abra o gerador de vídeo FLUX 3.
  2. Cole o Prompt A abaixo (multi-shot).
  3. Assista uma vez em tela cheia: rostos, clareza dos cortes, encaixe do áudio (se houver) e sobrevivência do crop em 9:16.
  4. Salve keepers; opcional: segundo passe com image to video a partir de um still que você já gosta em imagem.

Prompt A — multi-shot backyard joust

Multi-shot short film, 12 seconds, playful daylight backyard.
Shot 1 wide: two kids jousting with bright pool noodles, green grass, summer sun.
Shot 2 medium: slow motion near-miss as noodles clash, fabric and hair motion clear.
Shot 3 close-up: both kids laughing, natural faces, soft bokeh fence in background.
Natural ambient audio feel, no music bed, no text overlays, no watermark.

Prompt B — product hero spin

Product commercial, 8 seconds, clean studio.
Shot 1: matte black wireless earbuds case on white seamless, soft key light.
Shot 2: lid opens smoothly, earbuds catch a specular highlight.
Shot 3: earbud floats closer to camera, macro detail on mesh.
Subtle whoosh SFX energy, no logos other than the product shape, no watermark.

Prompt C — rainy neon street (mood)

Cinematic street clip, 10 seconds, night rain, neon reflections.
Single continuous push-in toward a woman laughing under a translucent umbrella,
wet asphalt, cyan and magenta signs, handheld micro-motion, natural skin texture.
City ambience and light rain SFX, no dialogue, no on-screen text, no watermark.

O que acompanhar em seguida

FAQ

O que é o FLUX 3?

O FLUX 3 é o modelo fundacional multimodal da Black Forest Labs de 23 de julho de 2026 para imagem, vídeo, áudio e predição de ação, treinado de forma conjunta em vez de como modelos monofuncionais separados (blog da BFL; thread de lançamento).

O FLUX 3 é só um modelo de vídeo?

Não. Os materiais públicos descrevem caminhos de vídeo, imagem, áudio e ação sob um design multimodal (modelos BFL). Neste site você pode começar com vídeo ou imagem.

Quanto podem durar os vídeos do FLUX 3?

A cobertura de lançamento cita clips de até cerca de 20 segundos na narrativa pública da BFL (The Decoder). Confirme sempre o controle de duração disponível na UI do gerador para o seu run.

O FLUX 3 suporta multi-shot em um único prompt?

Sim—é um highlight de criadores na semana de lançamento: vários planos a partir de um único prompt (venturetwins). Escreva linhas explícitas Shot 1 / Shot 2 / Shot 3 para melhor controle.

O que é áudio nativo no FLUX 3?

Áudio nativo significa que o modelo pode produzir som junto com o vídeo—ambiente, SFX e demos orientadas a diálogo aparecem na cobertura pública (The Decoder; lançamento BFL).

Em que o FLUX 3 difere do FLUX.2?

O FLUX.2 (nov. 2025) é o capítulo de geração e edição de imagem de produção (BFL FLUX.2). O FLUX 3 expande a família para um stack multimodal com narrativa de primeira classe em vídeo + áudio (BFL FLUX 3).

Posso testar o FLUX 3 grátis online?

Sim. Abra o gerador de vídeo FLUX 3 em flux3.video para começar grátis—sem cartão para iniciar. Stills: gerador de imagem.

Text to video ou image to video—qual primeiro?

Use text to video quando inventar uma cena do zero. Use image to video quando já tiver uma foto de produto ou still de personagem para animar—ambos ficam em vídeo.

As comparações de win-rate publicadas são finais?

Não. Taxas de preferência iniciais em artigos de lançamento são sinais preliminares reportados pelo fornecedor sob condições de teste específicas (The Decoder). Rode seus próprios prompts para decisões que importam.

Por onde devo começar agora?

Cole o Prompt A no gerador de vídeo, assista em tela cheia uma vez e depois itere descrições de planos—não só adjetivos.

Sobre Avery Lin

Avery Lin é analista de lançamentos de modelos de IA que acompanha releases da família FLUX e transforma fatos públicos do modelo em caminhos de teste claros para criadores no FLUX 3.

More Posts