TLDR
FLUX 3 は Black Forest Labs の 2026 年 7 月 23 日 発表のマルチモーダル基盤モデルです。公式ポジション:一つのアーキテクチャ が 画像・動画・音声 から合同学習し、ロボティクスパートナー向けのアクション予測パスも持つ(BFL ブログ;BFL モデル)。公開されている動画ハイライトは、約 20 秒 までのクリップ、1 本の prompt からマルチショット、ネイティブ音声(効果音・環境音・対話)(The Decoder による BFL 資料の要約;Justine Moore / a16z の早期メモ)。本サイト FLUX 3 では 動画ジェネレーター または 画像ジェネレーター を開き、無料で開始できます——試用開始にカードは不要です。
キーテイクアウェイ
- 出荷日: 公開 FLUX 3 ローンチは 2026 年 7 月 23 日(@bfl_ai;bfl.ai/blog/flux-3)。
- スコープ: 画像 + 動画 + 音声 + アクション予測を 一つのマルチモーダル 設計に統合(BFL モデル;ワイヤーリリース)。
- 動画の見出し機能: 最大約 ~20s 生成、1 prompt マルチショット、ネイティブ音声(The Decoder;venturetwins 早期メモ)。
- シリーズ文脈: FLUX.1(2024 画像時代)→ FLUX.2 画像/編集(2025 年 11 月)→ FLUX 3 マルチモーダル実世界モデル(BFL FLUX.2 投稿;BFL FLUX 3 投稿)。
- ここでの試用パス: FLUX 3 動画(ショートクリップのデフォルト)と FLUX 3 画像 が同一プロダクトワークスペースにあります。
実際に出荷されたもの
1. 統一されたマルチモーダルの訴求——「画像に動画を後付け」ではない
Black Forest Labs は FLUX 3 を、統一アーキテクチャ の中で 画像・動画・音声 から合同学習するものだと説明します。単一モダリティだけでは世界を捉えきれないからです(BFL ブログ;The Decoder)。同社はこれを real-world visual intelligence への前進——知覚し、予測し、(パートナー経由で)行動するモデル——として位置づけています(BFL 発表スレッド)。

日常からシネマティックまでのスチル言語 · FLUX 3 上の showcase スタイルフレーム
2. 動画:尺・マルチショット・ネイティブ音声
公開資料とローンチ週の報道が強調するのは次の点です。
| 能力 | 公開上の主張 | 主なソース | | --- | --- | --- | | 尺 | 動画クリップ最大おおよそ 20 秒 | The Decoder;CryptoBriefing | | マルチショット | 1 本の prompt から複数ショット/アングル | Justine Moore (a16z) | | ネイティブ音声 | クリップに揃ったサウンド(SFX・環境音・対話パス) | BFL ローンチの枠組み;The Decoder | | インターフェース | テキストから動画、画像から動画、および関連ワークフロー(公開ナラティブ) | The Decoder;本サイトの 動画ジェネレーター |
ローンチ報道に出る早期の選好表(例:短い 720p 比較)は ベンダー報告の早期シグナル であり、映画産業の独立認証ではありません(The Decoder チャート要約)。文脈 として使い、最終判断は 自分の prompt で行ってください。

Prompt-first のモーション言語 · FLUX 3 上の showcase キーフレーム
3. 同じファミリーの画像パス
公式投稿は FLUX 3 Image のサンプルを示し、スタイル・アスペクト比・解像度を横断した合成/編集をマルチモーダルスタックの一部として説明しています(BFL スレッド PS サンプル;BFL ブログ)。本プロダクトでは、スチルは 画像ジェネレーター にあり、FLUX 3 がハウス画像のデフォルトです。
4. アクション/ロボティクス(文脈であり、クリエイター主 CTA ではない)
BFL は Mimic Robotics との FLUX-mimic 協業や、Audi を含む産業テストの物語も発表しました(ローンチスレッド内の BFL アクション投稿;ワイヤーリリース)。「ワールドモデル」の物語には重要です。一方、ソーシャル広告・製品デモ・短編では、実用面は依然として 動画 + 画像生成 です。
5. シリーズ年表(FLUX → FLUX.2 → FLUX 3)
| 世代 | 公開テーマ | アンカー | | --- | --- | --- | | FLUX.1 時代 | FLUX をクリエイターの定番にしたオープン/画像生成の波 | BFL のシリーズ史 / Wikipedia 概要 | | FLUX.2 | 本番向け画像生成&編集(マルチ参照・高忠実度) | FLUX.2 ブログ、2025 年 11 月 25 日 | | FLUX 3 | マルチモーダル 動画 + 音声 + 画像 のバックボーン | FLUX 3 ブログ、2026 年 7 月 23 日 |
深掘り:FLUX 3 は誰向けか
ソーシャル/UGC マーケター
顔・動き・日常照明を保った短いクリップを、フル撮影日を雇わずに回す——それがマルチショット + ネイティブ音声が開く仕事です。テキストから動画 から始めてください。
プロダクト/グロースチーム
画像から動画は、パッケージスチルやヒーロー製品フレームを初稿のモーション広告に変えます。クリーンなスチルを用意し、同じ 動画ワークスペース でアニメーションします。
AI 映像作家・絵コンテ担当
1 prompt マルチショットは、ローンチ週のクリエイターが繰り返し投稿する差別化点です(venturetwins)。初期出力は 編集可能な初稿 として扱い、ショットごとに prompt を磨いてください。
すでに FLUX でスチルを作っているデザイナー
スチルで FLUX を知っているなら、FLUX 3 の公開ストーリーは「同じファミリーに、時間と音が乗った」です。スチルは 画像、モーションは 動画 に置いたまま進められます。
分かっていること vs. 分からないこと
| 分かっていること(ソース付き) | 分からない/主張しないこと | | --- | --- | | 公開ローンチ 2026 年 7 月 23 日、マルチモーダル位置づけ(@bfl_ai;BFL ブログ) | すべてのホスト・解像度・尺トグルが世界中で同一であること | | 動画ナラティブに ~20s・マルチショット・ネイティブ音声が含まれる(The Decoder) | すべての顔・手・全身回転で初テイク完璧が保証されること | | ローンチ報道に早期選好スコアがあり、それは 暫定(The Decoder) | 恒久的な「#1 動画モデル」を冠する独立・査読済みリーダーボード | | FLUX.2 が強い 画像 章を確立した(BFL FLUX.2) | スチルと動画があらゆる seed で同じ美的指紋を共有すること | | 本サイトは FLUX 3 ワークフロー向けにブラウザ 動画 と 画像 ジェネレーターを公開 | ベンダー横断の秒単価表(ここでは比較しない) |
ビルダーにとって重要な理由
- 1 回の生成で動画 + 音声 なら、初稿広告や説明動画のツール渡りが減る。
- マルチショットプロンプト はブリーフの書き方を変える——雰囲気 だけでなく カット を書く(マルチショット早期メモ)。
- FLUX ブランドの連続性 により、すでに FLUX スチル言語でプロンプトするチームが、新しい頭の切り替えなしにモーションへ移行できる。
- ブラウザ試用パス は、完璧なローカル導入を待たずに「自分の製品ショットがモーションに耐えるか」を確かめるのに向く。
本サイトで FLUX 3 を自分で評価する手順
- FLUX 3 動画ジェネレーター を開く。
- 下の Prompt A(マルチショット)を貼り付ける。
- フルスクリーンで一度観る:顔、カットの明瞭さ、音声のフィット(ある場合)、9:16 でのクロップ耐性。
- キーパーを保存;必要なら 画像 で気に入ったスチルから 画像から動画 の 2 パス目。
Prompt A — マルチショット 裏庭ジョウスト
Multi-shot short film, 12 seconds, playful daylight backyard.
Shot 1 wide: two kids jousting with bright pool noodles, green grass, summer sun.
Shot 2 medium: slow motion near-miss as noodles clash, fabric and hair motion clear.
Shot 3 close-up: both kids laughing, natural faces, soft bokeh fence in background.
Natural ambient audio feel, no music bed, no text overlays, no watermark.
Prompt B — 製品ヒーロー回転
Product commercial, 8 seconds, clean studio.
Shot 1: matte black wireless earbuds case on white seamless, soft key light.
Shot 2: lid opens smoothly, earbuds catch a specular highlight.
Shot 3: earbud floats closer to camera, macro detail on mesh.
Subtle whoosh SFX energy, no logos other than the product shape, no watermark.
Prompt C — 雨のネオン通り(ムード)
Cinematic street clip, 10 seconds, night rain, neon reflections.
Single continuous push-in toward a woman laughing under a translucent umbrella,
wet asphalt, cyan and magenta signs, handheld micro-motion, natural skin texture.
City ambience and light rain SFX, no dialogue, no on-screen text, no watermark.
次に注目すること
- クリエイター向けマルチショットレシピ(ショットリストを prompt に)——FLUX 3 動画:マルチショット・約20秒・ネイティブ音声 を参照。
- 画像から動画に渡すスチルのための 画像ワークフロー(画像ジェネレーター)。
- Self-Flow/マルチモーダルバックボーンに関する公式 BFL 研究ノートの追加公開(BFL research hub;The Decoder のアーキテクチャ要約 経由)。
FAQ
FLUX 3 とは何ですか?
FLUX 3 は Black Forest Labs の 2026 年 7 月 23 日 発表のマルチモーダル基盤モデルで、画像・動画・音声・アクション予測 を対象とし、単一目的モデルの寄せ集めではなく合同学習されています(BFL ブログ;ローンチスレッド)。
FLUX 3 は動画専用モデルですか?
いいえ。公開資料は 動画・画像・音声・アクション のパスを一つのマルチモーダル設計の下に記述しています(BFL モデル)。本サイトでは 動画 または 画像 から始められます。
FLUX 3 の動画はどのくらいの長さですか?
ローンチ報道では、BFL の公開ナラティブ上で約 20 秒 までのクリップが挙げられています(The Decoder)。実行時の尺コントロールは、常にジェネレーター UI で確認してください。
1 本の prompt でマルチショットは使えますか?
はい——ローンチ週のクリエイターハイライトです:単一 prompt から複数ショット(venturetwins)。制御を高めるには Shot 1 / Shot 2 / Shot 3 を明示してください。
FLUX 3 のネイティブ音声とは?
ネイティブ音声とは、モデルが 動画と同時に音 を出せるという意味です——環境音・SFX・対話寄りのデモが公開カバレッジに現れます(The Decoder;BFL ローンチ)。
FLUX 3 と FLUX.2 の違いは?
FLUX.2(2025 年 11 月)は本番向け 画像生成&編集 の章です(BFL FLUX.2)。FLUX 3 はファミリーを マルチモーダル スタックへ拡張し、動画 + 音声 のストーリーテリングを第一級に据えます(BFL FLUX 3)。
FLUX 3 をオンラインで無料試せますか?
はい。flux3.video の FLUX 3 動画ジェネレーター を開き、無料で開始できます——開始にカードは不要です。スチルは 画像ジェネレーター。
テキストから動画と画像から動画、どちらが先?
ゼロからシーンを作るなら テキストから動画。すでに製品写真やキャラクタースチルがあるなら 画像から動画——どちらも 動画 にあります。
公開されている勝率比較は最終結果ですか?
いいえ。ローンチ記事の早期選好率は、特定条件下の 暫定的なベンダー報告シグナル です(The Decoder)。重要な判断は自分の prompt で検証してください。
今すぐどこから始めるべきですか?
動画ジェネレーター に Prompt A を貼り、フルスクリーンで一度観てから、形容詞ではなくショット記述を反復してください。
Avery Lin について
Avery Lin は AI モデルリリースアナリスト。FLUX ファミリーのローンチを追い、公開モデルの事実をクリエイター向けの明確な試用パスに翻訳しています。
