TLDR
- 定好 場景任務(對話 / 戶外動作 / 情緒)。
- 寫 Shot 1 / 2 / 3,含機位尺寸 + 動詞。
- 用一行鎖 服裝、髮型、地點 連續性。
- 加 一個音訊優先級(對話能量 或 環境 或 SFX)。
- 在 影片 跑;全螢幕看一遍;留身份最好的那條。
核心要點
- 第一遍 = 故事可讀,不是最終調色級。
- 單 prompt 多鏡頭 是發布時創作者強調的差異點(venturetwins)。
- ~20s 是公開敘事的上限量級——不是每條 take 都要頂滿(The Decoder)。
- 原生音訊 意味著你可以有意指定環境底噪、說話能量或靜音(BFL)。
- 可選先做角色靜幀:圖像 → 圖生影片,身份更難鎖時用。
場景:「第一遍」是什麼意思
| 你想… | 把輸出當成… | 下一步 | | --- | --- | --- | | 向協作方提案短片 | 可分鏡的多鏡頭證明 | 只重寫弱的那一鏡 | | 測一段對話節拍 | 口型 + 反應檢查 | 特寫優先於極端全景 | | 探戶外能量 | 運鏡語法 + 服裝鎖定 | 更短時長、更少切鏡 |
第一遍 不要 在一條裡要五個地點、六個角色。兩個人、一個地方、三鏡就夠。
Prompt 1 — 廚房對話節拍(可複製)
Horizontal short-film scene, about 12 seconds, warm kitchen night, practical fairy lights bokeh.
Shot 1 medium two-shot: two friends at a small table with tea cups, soft eye contact.
Shot 2 over-shoulder: person A speaks with natural lip motion, gentle smile, steam rising.
Shot 3 reaction close-up: person B laughs, eyes crinkle, cup clinks lightly.
Same wardrobe and hairstyles across all shots, same table props and wall color.
Quiet room tone, light cup clink SFX, conversational dialogue energy, no loud score, no subtitles, no watermark.
Prompt 2 — 戶外動作微場景(可複製)
Horizontal action micro-scene, about 8 seconds, golden hour park path.
Shot 1 wide tracking: runner in red jacket jogs toward camera on gravel path.
Shot 2 side medium: arms and jacket fabric motion, trees streak softly.
Shot 3 low angle hero: runner passes camera, dust motes in sunbeams.
Same red jacket, black shorts, and shoes throughout; continuous park location.
Footsteps and light wind ambience, no music, no dialogue, no text, no watermark.
Prompt 3 — 情緒單人第一遍(可複製)
Horizontal contemplative scene, about 10 seconds, rainy city night, neon reflections on wet asphalt.
Shot 1 wide: lone figure under a bus shelter, umbrella closed, distant traffic bokeh.
Shot 2 medium: figure looks up, rain on coat fabric, subtle breath vapor.
Shot 3 close-up: eyes reflect neon, calm resolve, almost no head motion.
Same charcoal coat and scarf across shots, same shelter location continuity.
Rain ambience and distant traffic only, no music bed, no dialogue, no on-screen text, no watermark.

從日常到電影感的靜幀語言 · FLUX 3 展示用靜圖 · 第一遍規劃靜幀,非成片調色照
連續性鎖定(可直接偷這段)
自訂鏡頭表後貼上:
Continuity lock: same faces, hair, wardrobe colors, and location props in every shot.
No costume changes, no new characters, no logo watermarks, no random on-screen text.
若身份漂移,減少鏡頭數,或在 圖像 生成英雄靜幀,再在 影片 用圖生影片加動畫。
故事試片的通過/不通過
- 節拍順序 — 1→2→3 是否像有意的故事?
- 身份 — 跨切鏡是否同一批人?
- 地理 — 是否同一地點(除非你寫了插入鏡頭)?
- 手 / 臉 — 特寫是否可用?
- 音訊貼合 — 僅在口型可讀處要對話能量?
- 時長 — 每鏡是否夠長、讀得清?
兩項失敗 → 重寫 一行鏡頭,再生成。
在 flux3.video 上 3 步驗收
FAQ
這是成片短片嗎?
不是——這是 分鏡與連續性 用的 第一遍。剪輯、調色與聲音設計仍在下游。
為什麼用多鏡頭而不是一條長鏡頭?
公開 FLUX 3 創作者筆記強調 單 prompt 多鏡頭控制(venturetwins)。這與短片分鏡方式一致。
第一遍場景建議多長?
公開材料提到約 20 秒量級(The Decoder)。從 8–12 秒 起,每刀切鏡仍讀得清。
能拿到原生對話能量嗎?
可以——要自然對話語感,並把說話人放在 中景/特寫(BFL 音訊表述;The Decoder)。
何時用圖生影片?
角色造型已作為靜圖通過時。保住服裝;prompt 只寫機位 + 動作 + 音訊。
第一遍最多幾個人?
身份穩定前,兩人 是合理上限。
免費試用路徑?
相關包?
UGC 廣告 · 產品演示 · FLUX 3 影片:多鏡頭、約 20 秒與原生音訊。
關於 Reese Okada
Reese Okada 是 AI 影片工作流寫作者,把多鏡頭 prompt 整理成可在 FLUX 3 瀏覽器端重複執行的流程。
