期間限定30% OFF今すぐ確認

FLUX 3 とは?マルチモーダル動画・画像を無料でオンライン体験

著者: Avery Lin · 公開日: 2026-07-24 flux-3flux3black-forest-labsrelease-watchai-videotext-to-videomultimodal
FLUX 3 とは?マルチモーダル動画・画像を無料でオンライン体験

TLDR

FLUX 3 は Black Forest Labs の 2026 年 7 月 23 日 発表のマルチモーダル基盤モデルです。公式ポジション:一つのアーキテクチャ画像・動画・音声 から合同学習し、ロボティクスパートナー向けのアクション予測パスも持つ(BFL ブログBFL モデル)。公開されている動画ハイライトは、約 20 秒 までのクリップ、1 本の prompt からマルチショットネイティブ音声(効果音・環境音・対話)(The Decoder による BFL 資料の要約Justine Moore / a16z の早期メモ)。本サイト FLUX 3 では 動画ジェネレーター または 画像ジェネレーター を開き、無料で開始できます——試用開始にカードは不要です。

キーテイクアウェイ

実際に出荷されたもの

1. 統一されたマルチモーダルの訴求——「画像に動画を後付け」ではない

Black Forest Labs は FLUX 3 を、統一アーキテクチャ の中で 画像・動画・音声 から合同学習するものだと説明します。単一モダリティだけでは世界を捉えきれないからです(BFL ブログThe Decoder)。同社はこれを real-world visual intelligence への前進——知覚し、予測し、(パートナー経由で)行動するモデル——として位置づけています(BFL 発表スレッド)。

FLUX 3 動画リアリズム向けシネマティックスチル雰囲気 — FLUX 3 上の showcase

日常からシネマティックまでのスチル言語 · FLUX 3 上の showcase スタイルフレーム

2. 動画:尺・マルチショット・ネイティブ音声

公開資料とローンチ週の報道が強調するのは次の点です。

| 能力 | 公開上の主張 | 主なソース | | --- | --- | --- | | | 動画クリップ最大おおよそ 20 秒 | The DecoderCryptoBriefing | | マルチショット | 1 本の prompt から複数ショット/アングル | Justine Moore (a16z) | | ネイティブ音声 | クリップに揃ったサウンド(SFX・環境音・対話パス) | BFL ローンチの枠組みThe Decoder | | インターフェース | テキストから動画、画像から動画、および関連ワークフロー(公開ナラティブ) | The Decoder;本サイトの 動画ジェネレーター |

ローンチ報道に出る早期の選好表(例:短い 720p 比較)は ベンダー報告の早期シグナル であり、映画産業の独立認証ではありません(The Decoder チャート要約)。文脈 として使い、最終判断は 自分の prompt で行ってください。

テキストから動画のキーフレームスタイル — 砂漠チェイスのエネルギー · FLUX 3 上の showcase

Prompt-first のモーション言語 · FLUX 3 上の showcase キーフレーム

3. 同じファミリーの画像パス

公式投稿は FLUX 3 Image のサンプルを示し、スタイル・アスペクト比・解像度を横断した合成/編集をマルチモーダルスタックの一部として説明しています(BFL スレッド PS サンプルBFL ブログ)。本プロダクトでは、スチルは 画像ジェネレーター にあり、FLUX 3 がハウス画像のデフォルトです。

4. アクション/ロボティクス(文脈であり、クリエイター主 CTA ではない)

BFL は Mimic Robotics との FLUX-mimic 協業や、Audi を含む産業テストの物語も発表しました(ローンチスレッド内の BFL アクション投稿ワイヤーリリース)。「ワールドモデル」の物語には重要です。一方、ソーシャル広告・製品デモ・短編では、実用面は依然として 動画 + 画像生成 です。

5. シリーズ年表(FLUX → FLUX.2 → FLUX 3)

| 世代 | 公開テーマ | アンカー | | --- | --- | --- | | FLUX.1 時代 | FLUX をクリエイターの定番にしたオープン/画像生成の波 | BFL のシリーズ史 / Wikipedia 概要 | | FLUX.2 | 本番向け画像生成&編集(マルチ参照・高忠実度) | FLUX.2 ブログ、2025 年 11 月 25 日 | | FLUX 3 | マルチモーダル 動画 + 音声 + 画像 のバックボーン | FLUX 3 ブログ、2026 年 7 月 23 日 |

深掘り:FLUX 3 は誰向けか

ソーシャル/UGC マーケター

顔・動き・日常照明を保った短いクリップを、フル撮影日を雇わずに回す——それがマルチショット + ネイティブ音声が開く仕事です。テキストから動画 から始めてください。

プロダクト/グロースチーム

画像から動画は、パッケージスチルやヒーロー製品フレームを初稿のモーション広告に変えます。クリーンなスチルを用意し、同じ 動画ワークスペース でアニメーションします。

AI 映像作家・絵コンテ担当

1 prompt マルチショットは、ローンチ週のクリエイターが繰り返し投稿する差別化点です(venturetwins)。初期出力は 編集可能な初稿 として扱い、ショットごとに prompt を磨いてください。

すでに FLUX でスチルを作っているデザイナー

スチルで FLUX を知っているなら、FLUX 3 の公開ストーリーは「同じファミリーに、時間と音が乗った」です。スチルは 画像、モーションは 動画 に置いたまま進められます。

分かっていること vs. 分からないこと

| 分かっていること(ソース付き) | 分からない/主張しないこと | | --- | --- | | 公開ローンチ 2026 年 7 月 23 日、マルチモーダル位置づけ(@bfl_aiBFL ブログ) | すべてのホスト・解像度・尺トグルが世界中で同一であること | | 動画ナラティブに ~20s・マルチショット・ネイティブ音声が含まれる(The Decoder) | すべての顔・手・全身回転で初テイク完璧が保証されること | | ローンチ報道に早期選好スコアがあり、それは 暫定The Decoder) | 恒久的な「#1 動画モデル」を冠する独立・査読済みリーダーボード | | FLUX.2 が強い 画像 章を確立した(BFL FLUX.2) | スチルと動画があらゆる seed で同じ美的指紋を共有すること | | 本サイトは FLUX 3 ワークフロー向けにブラウザ 動画画像 ジェネレーターを公開 | ベンダー横断の秒単価表(ここでは比較しない) |

ビルダーにとって重要な理由

  1. 1 回の生成で動画 + 音声 なら、初稿広告や説明動画のツール渡りが減る。
  2. マルチショットプロンプト はブリーフの書き方を変える——雰囲気 だけでなく カット を書く(マルチショット早期メモ)。
  3. FLUX ブランドの連続性 により、すでに FLUX スチル言語でプロンプトするチームが、新しい頭の切り替えなしにモーションへ移行できる。
  4. ブラウザ試用パス は、完璧なローカル導入を待たずに「自分の製品ショットがモーションに耐えるか」を確かめるのに向く。

本サイトで FLUX 3 を自分で評価する手順

  1. FLUX 3 動画ジェネレーター を開く。
  2. 下の Prompt A(マルチショット)を貼り付ける。
  3. フルスクリーンで一度観る:顔、カットの明瞭さ、音声のフィット(ある場合)、9:16 でのクロップ耐性。
  4. キーパーを保存;必要なら 画像 で気に入ったスチルから 画像から動画 の 2 パス目。

Prompt A — マルチショット 裏庭ジョウスト

Multi-shot short film, 12 seconds, playful daylight backyard.
Shot 1 wide: two kids jousting with bright pool noodles, green grass, summer sun.
Shot 2 medium: slow motion near-miss as noodles clash, fabric and hair motion clear.
Shot 3 close-up: both kids laughing, natural faces, soft bokeh fence in background.
Natural ambient audio feel, no music bed, no text overlays, no watermark.

Prompt B — 製品ヒーロー回転

Product commercial, 8 seconds, clean studio.
Shot 1: matte black wireless earbuds case on white seamless, soft key light.
Shot 2: lid opens smoothly, earbuds catch a specular highlight.
Shot 3: earbud floats closer to camera, macro detail on mesh.
Subtle whoosh SFX energy, no logos other than the product shape, no watermark.

Prompt C — 雨のネオン通り(ムード)

Cinematic street clip, 10 seconds, night rain, neon reflections.
Single continuous push-in toward a woman laughing under a translucent umbrella,
wet asphalt, cyan and magenta signs, handheld micro-motion, natural skin texture.
City ambience and light rain SFX, no dialogue, no on-screen text, no watermark.

次に注目すること

FAQ

FLUX 3 とは何ですか?

FLUX 3 は Black Forest Labs の 2026 年 7 月 23 日 発表のマルチモーダル基盤モデルで、画像・動画・音声・アクション予測 を対象とし、単一目的モデルの寄せ集めではなく合同学習されています(BFL ブログローンチスレッド)。

FLUX 3 は動画専用モデルですか?

いいえ。公開資料は 動画・画像・音声・アクション のパスを一つのマルチモーダル設計の下に記述しています(BFL モデル)。本サイトでは 動画 または 画像 から始められます。

FLUX 3 の動画はどのくらいの長さですか?

ローンチ報道では、BFL の公開ナラティブ上で約 20 秒 までのクリップが挙げられています(The Decoder)。実行時の尺コントロールは、常にジェネレーター UI で確認してください。

1 本の prompt でマルチショットは使えますか?

はい——ローンチ週のクリエイターハイライトです:単一 prompt から複数ショットventuretwins)。制御を高めるには Shot 1 / Shot 2 / Shot 3 を明示してください。

FLUX 3 のネイティブ音声とは?

ネイティブ音声とは、モデルが 動画と同時に音 を出せるという意味です——環境音・SFX・対話寄りのデモが公開カバレッジに現れます(The DecoderBFL ローンチ)。

FLUX 3 と FLUX.2 の違いは?

FLUX.2(2025 年 11 月)は本番向け 画像生成&編集 の章です(BFL FLUX.2)。FLUX 3 はファミリーを マルチモーダル スタックへ拡張し、動画 + 音声 のストーリーテリングを第一級に据えます(BFL FLUX 3)。

FLUX 3 をオンラインで無料試せますか?

はい。flux3.video の FLUX 3 動画ジェネレーター を開き、無料で開始できます——開始にカードは不要です。スチルは 画像ジェネレーター

テキストから動画と画像から動画、どちらが先?

ゼロからシーンを作るなら テキストから動画。すでに製品写真やキャラクタースチルがあるなら 画像から動画——どちらも 動画 にあります。

公開されている勝率比較は最終結果ですか?

いいえ。ローンチ記事の早期選好率は、特定条件下の 暫定的なベンダー報告シグナル です(The Decoder)。重要な判断は自分の prompt で検証してください。

今すぐどこから始めるべきですか?

動画ジェネレーター に Prompt A を貼り、フルスクリーンで一度観てから、形容詞ではなくショット記述を反復してください。

Avery Lin について

Avery Lin は AI モデルリリースアナリスト。FLUX ファミリーのローンチを追い、公開モデルの事実をクリエイター向けの明確な試用パスに翻訳しています。

More Posts