TLDR
- FLUX 3 動画 を開く。
- 曖昧な雰囲気ではなく Shot 1 / Shot 2 / Shot 3(誰・カメラ・アクション)を書く。
- 野心を抑える:初稿は尺を最大にする前に 約 8–12 秒 の明瞭さを狙う。
- 音声インテント(環境音/SFX/音楽なし)を1行で追加。
- フルスクリーン確認:顔、カット論理、手、発話時の口の動き、Reels 向けクロップ。
- 任意:画像 でヒーロースチルを固め、画像から動画。
キーテイクアウェイ
- マルチショットは第一級スキル: 早期アクセスのクリエイターは 1 回の生成で複数アングル を強調(venturetwins)。
- 約 20 秒は公開上の上限ナラティブ——すべてのテイクの必須条件ではない(The Decoder)。
- ネイティブ音声 により、常に後から同期する代わりに、環境音/SFX/対話のエネルギーを指定できる(BFL ローンチ;The Decoder)。
- 形容詞より prompt 構造: ショットを番号付けし、カメラを名付け、衣装の連続性を固定。
- マネープージ: 以下はすべて 動画ジェネレーター 上で動く(テキストから動画・画像から動画)。
始める前に(60 秒チェックリスト)
| チェック | 理由 | | --- | --- | | 本当の仕事がある(UGC 広告、製品スピン、対話ビート) | ランダムな「epic」prompt は無料ランを浪費する | | 紙に 2–4 ショット を列挙できる | マルチショットモデルは明示的なカットに報いる | | 衣装/被写体が 1 行で明確 | アイデンティティのドリフトは曖昧なキャラから始まることが多い | | アスペクト比を知っている(9:16、16:9、1:1) | ソーシャルクロップは良いセンターを殺す | | フルスクリーンで一度確認する | サムネ見た目は顔と手について嘘をつく |
ステップ 1 — FLUX 3 動画ジェネレーターを開く
FLUX 3 動画 へ。ハウス動画モデルとして FLUX 3 を選択したままにします。テキストから動画 と 画像から動画 の両方でこのページに留まります——基本ループに第二のプロダクトは不要です。
先にスチルが必要? FLUX 3 画像 でヒーローフレームを生成/調整し、保存してから動画でアニメーションします。
ステップ 2 — マルチショット prompt を書く(中核スキル)
毎回この骨格を使います。
- フォーマット行 — 尺の意図、アスペクト、ジャンル。
- ショットリスト — Shot 1 wide / Shot 2 medium / Shot 3 close(動作動詞)。
- 連続性の行 — 同じ人物、同じ服、同じ場所。
- 音声の行 — 環境音、SFX、対話または無音。
- ネガティブ — 透かしなし、余分なロゴなし、ランダムテキストなし。
Prompt 1 — マルチショット製品開封(コピペ)
Vertical 9:16 product ad, about 10 seconds, clean desk daylight.
Shot 1 wide: sealed matte white product box on oak table, soft window light.
Shot 2 medium: hands open the box lid smoothly, tissue paper folds clearly.
Shot 3 close-up: wireless earbuds lift toward camera, subtle specular highlight.
Same hands, same box branding color, continuous desk environment.
Soft paper rustle and light whoosh SFX, no music bed, no on-screen text, no watermark.
Prompt 2 — マルチショット対話ビート
Horizontal short scene, about 12 seconds, warm kitchen night.
Shot 1 medium two-shot: two friends at a small table, tea cups, fairy lights bokeh.
Shot 2 over-shoulder: person A speaks with natural lip motion, soft smile.
Shot 3 reaction close-up: person B laughs, eyes crinkle, steam rises from cup.
Same wardrobe and hairstyles across all shots, consistent table props.
Quiet room tone plus light cup clink SFX; dialogue energy, no loud score, no subtitles, no watermark.
Prompt 3 — マルチショット屋外アクション(シンプル)
Horizontal action clip, about 8 seconds, golden hour park path.
Shot 1 wide tracking: runner in red jacket jogs toward camera on gravel path.
Shot 2 side medium: arms and jacket fabric motion, trees streak softly.
Shot 3 low angle hero: runner passes, dust motes in sunbeams.
Same red jacket and black shorts throughout.
Footsteps and light wind ambience, no music, no text, no watermark.

Prompt-first のモーション言語 · FLUX 3 上の showcase キーフレーム · 計画用の generated-style スチルであり、グレーディング済みフィルムスチルではない
ステップ 3 — ネイティブ音声を意図的に入れる
FLUX 3 の公開ストーリーには、動画と一体の ネイティブ音声 が含まれます(BFL;The Decoder)。音声は後付けではなく 演出の1行 として扱います。
| 意図 | 例の行 | | --- | --- | | 環境音のみ | “city night ambience and light rain, no music, no dialogue” | | SFX ヒット | “soft whoosh on logo settle, no voiceover” | | 対話エネルギー | “natural conversational speech, quiet room tone, no score” | | 無音 | “no music, no SFX, no dialogue—picture only” |
リップシンクのコツ: 話す顔を クローズまたはミディアム に置き、「natural lip motion」と明示する(Prompt 2)。全身の極端なワイドは口のディテールが判断しにくいです。
ステップ 4 — テキストから動画 vs 画像から動画
| 起点 | 使うとき | パス | | --- | --- | --- | | テキストから動画 | シーン全体を発明する | 動画ジェネレーター | | 画像から動画 | 製品写真・キャラクターフレーム・ポスターがすでにある | 同じ 動画ページ;任意で 画像 のスチル |
画像から動画のレシピ: スチルはシンプルに(被写体1つ、輪郭がはっきり)、prompt は モーション + カメラ + 音声 だけ——別の服装を再記述しない。
Image-to-video, 6 seconds, gentle push-in.
Preserve the exact product, colors, and logo from the reference still.
Soft studio light consistency, subtle rotation of the product, clean background.
Soft whoosh SFX, no new text, no watermark.
ステップ 5 — 合格/不合格チェックリスト(フルスクリーン)
一度スクラブせずに観て、その後スクラブします。
- カット論理 — Shot 1→2→3 が意図的に読めるか?
- アイデンティティ — カットをまたいで同じ顔・髪・衣装か?
- 手/小道具 — 余分な指、溶ける箱、滑るラベルはないか?
- 音声フィット — 音がイベントに合うか(または無音を要求したか)?
- クロップ — 顔と製品は 9:16 で安全か?
- テキスト汚染 — ランダムな字形や透かしはないか?
2 項目以上が不合格なら、ランを燃やす前に ショットリストを書き直す。多くの場合の修正は形容詞の追加ではなく、より短く明確なショット です。
よくある失敗モード(と修正)
| 症状 | 想定原因 | 修正 | | --- | --- | --- | | 長い一本の連続ショット | 番号付きショットがない | Shot 1/2/3 を明示 | | カット間でキャラが変形 | 衣装が曖昧 | 服/髪を固定する1文 | | 音声がごちゃつく | 音楽 + 対話 + SFX が競合 | 音声の優先順位を 1 つ に | | 顔は良いが製品ロゴが悪い | カメラが忙しすぎる | ゆっくりプッシュイン;カットを減らす | | 16:9 は良いが 9:16 が崩れる | prompt にアスペクトがない | vertical 9:16 + 被写体を中央に |
FLUX 3 で回す 3 ステップ評価ループ
FAQ
FLUX 3 動画のプロンプトは何が違う?
公開クリエイターメモは 単一 prompt からのマルチショット制御 と強いマイクロディテールを強調します(venturetwins;BFL ローンチ)。ムードだけでなく カット を書いてください。
最初の FLUX 3 クリップはどの長さが良い?
公開資料は約 20 秒 までの生成に言及します(The Decoder)。マルチショット学習では、各ビートが読めるよう 8–12 秒 前後から始めましょう。
ショットはいくつ依頼すべき?
初稿は 2〜4。安定したキャラ行がないうちにショットを増やすと連続性リスクが上がります。
FLUX 3 はネイティブ音声とリップシンクができる?
ネイティブ音声は公式マルチモーダルストーリーの一部です(BFL;The Decoder)。コミュニティデモでも口の動きが強調されます——自分のテイクを必ず 聞き、ズーム して確認してください。
テキストから動画と画像から動画、どちら?
発明したシーンは テキストから動画;ブランドスチルがすでにあるなら 画像から動画。どちらも 動画ジェネレーター にあります。
画像ページは必要?
制御されたスチルを先に作りたいときだけ。画像 で生成し、動画でアニメーションします。
なぜマルチショットが一本の連続テイクに潰れる?
番号付きショットとカメラサイズが不足している可能性が高いです。ステップ 2 の骨格を使ってください。
音楽を禁止できる?
はい——音声行で 「no music bed」 または 「picture only, no SFX」 と書きます。
どこで無料で試せる?
flux3.video の FLUX 3 動画 を開き、無料で開始——開始にカードは不要です。
次に読むべきものは?
リリース概要:FLUX 3 とは?。
Reese Okada について
Reese Okada は AI 動画ワークフローライター。マルチショット prompt を FLUX 3 上の再現可能なブラウザワークフローに落とし込んでいます。
