TLDR
- 定好 场景任务(对话 / 户外动作 / 情绪)。
- 写 Shot 1 / 2 / 3,含机位尺寸 + 动词。
- 用一行锁 服装、发型、地点 连续性。
- 加 一个音频优先级(对话能量 或 环境 或 SFX)。
- 在 视频 跑;全屏看一遍;留身份最好的那条。
核心要点
- 第一遍 = 故事可读,不是最终调色级。
- 单 prompt 多镜头 是发布时创作者强调的差异点(venturetwins)。
- ~20s 是公开叙事的上限量级——不是每条 take 都要顶满(The Decoder)。
- 原生音频 意味着你可以有意指定环境底噪、说话能量或静音(BFL)。
- 可选先做角色静帧:图像 → 图生视频,身份更难锁时用。
场景:「第一遍」是什么意思
| 你想… | 把输出当成… | 下一步 | | --- | --- | --- | | 向协作方提案短片 | 可分镜的多镜头证明 | 只重写弱的那一镜 | | 测一段对话节拍 | 口型 + 反应检查 | 特写优先于极端全景 | | 探户外能量 | 运镜语法 + 服装锁定 | 更短时长、更少切镜 |
第一遍 不要 在一条里要五个地点、六个角色。两个人、一个地方、三镜就够。
Prompt 1 — 厨房对话节拍(可复制)
Horizontal short-film scene, about 12 seconds, warm kitchen night, practical fairy lights bokeh.
Shot 1 medium two-shot: two friends at a small table with tea cups, soft eye contact.
Shot 2 over-shoulder: person A speaks with natural lip motion, gentle smile, steam rising.
Shot 3 reaction close-up: person B laughs, eyes crinkle, cup clinks lightly.
Same wardrobe and hairstyles across all shots, same table props and wall color.
Quiet room tone, light cup clink SFX, conversational dialogue energy, no loud score, no subtitles, no watermark.
Prompt 2 — 户外动作微场景(可复制)
Horizontal action micro-scene, about 8 seconds, golden hour park path.
Shot 1 wide tracking: runner in red jacket jogs toward camera on gravel path.
Shot 2 side medium: arms and jacket fabric motion, trees streak softly.
Shot 3 low angle hero: runner passes camera, dust motes in sunbeams.
Same red jacket, black shorts, and shoes throughout; continuous park location.
Footsteps and light wind ambience, no music, no dialogue, no text, no watermark.
Prompt 3 — 情绪单人第一遍(可复制)
Horizontal contemplative scene, about 10 seconds, rainy city night, neon reflections on wet asphalt.
Shot 1 wide: lone figure under a bus shelter, umbrella closed, distant traffic bokeh.
Shot 2 medium: figure looks up, rain on coat fabric, subtle breath vapor.
Shot 3 close-up: eyes reflect neon, calm resolve, almost no head motion.
Same charcoal coat and scarf across shots, same shelter location continuity.
Rain ambience and distant traffic only, no music bed, no dialogue, no on-screen text, no watermark.

从日常到电影感的静帧语言 · FLUX 3 展示用静图 · 第一遍规划静帧,非成片调色照
连续性锁定(可直接偷这段)
自定义镜头表后粘贴:
Continuity lock: same faces, hair, wardrobe colors, and location props in every shot.
No costume changes, no new characters, no logo watermarks, no random on-screen text.
若身份漂移,减少镜头数,或在 图像 生成英雄静帧,再在 视频 用图生视频加动画。
故事试片的通过/不通过
- 节拍顺序 — 1→2→3 是否像有意的故事?
- 身份 — 跨切镜是否同一批人?
- 地理 — 是否同一地点(除非你写了插入镜头)?
- 手 / 脸 — 特写是否可用?
- 音频贴合 — 仅在口型可读处要对话能量?
- 时长 — 每镜是否够长、读得清?
两项失败 → 重写 一行镜头,再生成。
在 flux3.video 上 3 步验收
FAQ
这是成片短片吗?
不是——这是 分镜与连续性 用的 第一遍。剪辑、调色与声音设计仍在下游。
为什么用多镜头而不是一条长镜头?
公开 FLUX 3 创作者笔记强调 单 prompt 多镜头控制(venturetwins)。这与短片分镜方式一致。
第一遍场景建议多长?
公开材料提到约 20 秒量级(The Decoder)。从 8–12 秒 起,每刀切镜仍读得清。
能拿到原生对话能量吗?
可以——要自然对话语感,并把说话人放在 中景/特写(BFL 音频表述;The Decoder)。
何时用图生视频?
角色造型已作为静图通过时。保住服装;prompt 只写机位 + 动作 + 音频。
第一遍最多几个人?
身份稳定前,两人 是合理上限。
免费试用路径?
相关包?
UGC 广告 · 产品演示 · FLUX 3 视频:多镜头、约 20 秒与原生音频。
关于 Reese Okada
Reese Okada 是 AI 视频工作流写作者,把多镜头 prompt 整理成可在 FLUX 3 浏览器端重复执行的流程。
