限時 7 折優惠!領取優惠

FLUX 3 影片:多鏡頭、約 20 秒與原生音訊

作者 Reese Okada · 發佈於 2026-07-24 flux-3flux3multi-shottext-to-videoimage-to-videonative-audiohow-to
FLUX 3 影片:多鏡頭、約 20 秒與原生音訊

TLDR

  1. 打開 FLUX 3 影片
  2. Shot 1 / Shot 2 / Shot 3(人物、機位、動作),而不是一句含糊氛圍。
  3. 控制野心:初稿先求 約 8–12 秒 清楚,再衝最長。
  4. 用一行寫清 音訊意圖(環境 / SFX / 不要配樂)。
  5. 全屏復盤:臉、分鏡邏輯、手、說話時的口型、Reels 裁切。
  6. 可選:在 圖像 鎖定英雄靜幀,再 圖生影片

核心要點

  • 多鏡頭是一等技能: 早期體驗創作者強調一次生成裡多個角度(venturetwins)。
  • ~20s 是公開敘事的上限量級——不是每次都必須頂滿(The Decoder)。
  • 原生音訊 讓你可以指定環境/SFX/對話能量,而不總是後期硬配(BFL 發布The Decoder)。
  • 結構勝過形容詞: 給鏡頭編號、寫清機位、鎖服裝連續性。
  • 在這裡試: 把下面的 prompt 貼進 影片生成器(文生影片 + 圖生影片)。

開始前(60 秒清單)

| 檢查 | 為什麼 | | --- | --- | | 你有一個 真實任務(UGC 廣告、產品旋轉、對話節拍) | 空洞「史詩」prompt 浪費免費次數 | | 能在紙上列出 2–4 個鏡頭 | 多鏡頭模型獎勵明確切鏡 | | 服裝 / 主體用 一句說清 | 身份漂移常從角色描寫含糊開始 | | 你知道 畫幅(9:16、16:9、1:1) | 社媒裁切會毀掉好構圖 | | 你會 全屏看一遍 | 縮略圖會騙你關於臉和手 |

步驟 1 — 打開 FLUX 3 影片生成器

進入 FLUX 3 影片。保持 FLUX 3 為房屋影片模型。文生影片圖生影片 都在本頁完成——基礎循環不需要第二個產品。

需要先靜幀?在 FLUX 3 圖像 生成或微調英雄幀,保存後再到影片側加運動。

步驟 2 — 寫多鏡頭 prompt(核心技能)

每次用這套骨架:

  1. 格式行 — 時長意圖、畫幅、類型。
  2. 鏡頭表 — Shot 1 全景 / Shot 2 中景 / Shot 3 特寫(動詞寫動作)。
  3. 連續性行 — 同一人物、服裝、地點。
  4. 音訊行 — 環境、SFX、對話或靜音。
  5. 負向 — 無水印、無多餘 logo、無亂字。

Prompt 1 — 多鏡頭產品開箱(可複製)

Vertical 9:16 product ad, about 10 seconds, clean desk daylight.
Shot 1 wide: sealed matte white product box on oak table, soft window light.
Shot 2 medium: hands open the box lid smoothly, tissue paper folds clearly.
Shot 3 close-up: wireless earbuds lift toward camera, subtle specular highlight.
Same hands, same box branding color, continuous desk environment.
Soft paper rustle and light whoosh SFX, no music bed, no on-screen text, no watermark.

Prompt 2 — 多鏡頭對話節拍

Horizontal short scene, about 12 seconds, warm kitchen night.
Shot 1 medium two-shot: two friends at a small table, tea cups, fairy lights bokeh.
Shot 2 over-shoulder: person A speaks with natural lip motion, soft smile.
Shot 3 reaction close-up: person B laughs, eyes crinkle, steam rises from cup.
Same wardrobe and hairstyles across all shots, consistent table props.
Quiet room tone plus light cup clink SFX; dialogue energy, no loud score, no subtitles, no watermark.

Prompt 3 — 多鏡頭戶外動作(簡單)

Horizontal action clip, about 8 seconds, golden hour park path.
Shot 1 wide tracking: runner in red jacket jogs toward camera on gravel path.
Shot 2 side medium: arms and jacket fabric motion, trees streak softly.
Shot 3 low angle hero: runner passes, dust motes in sunbeams.
Same red jacket and black shorts throughout.
Footsteps and light wind ambience, no music, no text, no watermark.

文生影片風格關鍵幀 · FLUX 3 showcase

Prompt-first 運動語言 · FLUX 3 showcase 關鍵幀 · 規劃用示意靜幀,非成片調色照

步驟 3 — 有意加入原生音訊

FLUX 3 的公開故事包含影片上的 native audioBFLThe Decoder)。把音訊當成 導演指令,而不是事後補丁:

| 意圖 | 示例行 | | --- | --- | | 只要環境 | 「city night ambience and light rain, no music, no dialogue」 | | SFX 點題 | 「soft whoosh on logo settle, no voiceover」 | | 對話能量 | 「natural conversational speech, quiet room tone, no score」 | | 靜音 | 「no music, no SFX, no dialogue—picture only」 |

口型提示: 說話臉放在 中近景或特寫,並顯式寫 「natural lip motion」(見 Prompt 2)。極端全身遠景很難判斷嘴型。

步驟 4 — 文生影片 vs 圖生影片

| 從哪起步 | 何時用 | 路徑 | | --- | --- | --- | | 文生影片 | 從零發明場景 | 影片生成器 | | 圖生影片 | 已有產品照、角色幀或海報 | 同一 影片頁;靜幀可選自 圖像 |

圖生影片配方: 靜幀儘量簡單(單一主體、邊緣清晰),prompt 只寫 運動 + 機位 + 音訊——不要重寫一套不同服裝。

Image-to-video, 6 seconds, gentle push-in.
Preserve the exact product, colors, and logo from the reference still.
Soft studio light consistency, subtle rotation of the product, clean background.
Soft whoosh SFX, no new text, no watermark.

步驟 5 — 通過/不通過清單(全屏)

先不拖進度條看一遍,再精查:

  1. 分鏡邏輯 — Shot 1→2→3 是否像有意的剪輯?
  2. 身份 — 臉、髮型、服裝跨鏡頭一致嗎?
  3. 手 / 道具 — 多手指、融化盒子、滑動標籤?
  4. 音訊貼合 — 聲畫是否對應(或你是否要求靜音)?
  5. 裁切 — 臉與產品在 9:16 是否安全?
  6. 亂字 — 隨機字符或水印?

若有兩項失敗,先改 shot list 再燒次數。通常修的是更短、更清楚的鏡頭,不是更多形容詞。

常見失敗與修法

| 症狀 | 可能原因 | 修法 | | --- | --- | --- | | 變成一條長連續鏡頭 | 沒有編號鏡頭 | 加顯式 Shot 1/2/3 | | 角色跨鏡變形 | 服裝含糊 | 用一句鎖死衣服/髮型 | | 音訊雜亂 | 配樂 + 對話 + SFX 搶戲 | 只保留 一個 音訊優先級 | | 臉好看但產品 logo 糊 | 運鏡太亂 | 慢推近;少切鏡 | | 16:9 好、9:16 崩 | prompt 未寫畫幅 | 寫明 vertical 9:16 + 主體居中 |

在 FLUX 3 上跑 3 步驗收環

  1. 打開 FLUX 3 影片
  2. 粘貼 Prompt 1(或用骨架寫的真實 brief)。
  3. 用清單判斷 → 保存 keeper → 可選從 圖像 靜幀再圖生影片。

FAQ

FLUX 3 影片在 prompting 上有何不同?

公開創作者筆記強調 單 prompt 多鏡頭控制 與更強的微細節(venturetwinsBFL 發布)。寫 切鏡,不要只寫情緒。

第一支片建議多長?

公開材料討論約 20 秒量級(The Decoder)。學多鏡頭時從 約 8–12 秒 開始,每個節拍才讀得清。

建議寫幾個鏡頭?

初稿 2–4 個。鏡頭更多會在角色線穩定前抬高連續性風險。

FLUX 3 能做原生音訊與口型嗎?

原生音訊是官方多模態故事的一部分(BFLThe Decoder)。社區 demo 也強調嘴型——務必 放大 驗收自己的成片。

該文生影片還是圖生影片?

編造場景用 文生影片;已有品牌靜幀用 圖生影片。都在 影片生成器

需要圖像頁嗎?

只有當你想先控靜幀時需要。先在 圖像 生成,再到影片加運動。

為什麼多鏡頭塌成一條長鏡頭?

多半缺少編號鏡頭與機位尺寸。用步驟 2 的骨架。

能禁止配樂嗎?

可以——在音訊行寫 「no music bed」「picture only, no SFX」

在哪裡免費試用?

打開 FLUX 3 影片,無需先綁卡即可開始。

下一步讀什麼?

發布總覽:什麼是 FLUX 3?

關於 Reese Okada

Reese Okada 是 AI 影片工作流寫作者,把多鏡頭 prompt 整理成可在 FLUX 3 瀏覽器端重複執行的流程。

More Posts