TLDR
- Откройте FLUX 3 video.
- Пишите Shot 1 / Shot 2 / Shot 3 (who, camera, action) вместо одного размытого vibe.
- Ограничьте амбиции: для first drafts целитесь в ясность ~8–12 с, прежде чем max length.
- Добавьте audio intent (ambience / SFX / no music) одной строкой.
- Full-screen review: faces, cut logic, hands, lip motion если речь, crop под Reels.
- Опционально: зафиксируйте hero still на image, затем image to video.
Ключевые выводы
- Multi-shot — first-class skill: creators с early access выделяют несколько ракурсов в одной генерации (venturetwins).
- ~20 с — публичный ceiling narrative — не требование для каждого take (The Decoder).
- Native audio значит, что вы можете задать ambience/SFX/dialogue energy вместо всегда post-sync позже (запуск BFL; The Decoder).
- Структура промпта бьёт прилагательные: нумеруйте shots, называйте camera, фиксируйте wardrobe continuity.
- Try here: всё ниже крутится на video generator (text-to-video и image-to-video).
Перед стартом (60-секундный чеклист)
| Проверка | Зачем | | --- | --- | | У вас есть реальная задача (UGC ad, product spin, dialogue beat) | Случайные «epic» промпты сжигают free runs | | Вы можете перечислить 2–4 shots на бумаге | Multi-shot модели вознаграждают явные cuts | | Wardrobe / subject — одна ясная строка | Identity drift часто начинается с размытых персонажей | | Вы знаете aspect ratio (9:16, 16:9, 1:1) | Social crops убивают хорошие centers | | Вы сделаете full screen review один раз | Thumbnail врёт про faces и hands |
Шаг 1 — Откройте FLUX 3 video generator
Перейдите на FLUX 3 video. Оставьте FLUX 3 как house video model. Оставайтесь на этой странице и для text to video, и для image to video — для базового loop второй продукт не нужен.
Нужны stills сначала? Сгенерируйте или доведите hero frame на FLUX 3 image, скачайте/сохраните, затем анимируйте на video.
Шаг 2 — Пишите multi-shot промпты (core skill)
Используйте этот skeleton каждый раз:
- Format line — duration intent, aspect, genre.
- Shot list — Shot 1 wide / Shot 2 medium / Shot 3 close (action verbs).
- Continuity line — same people, same clothes, same location.
- Audio line — ambience, SFX, dialogue или silence.
- Negatives — no watermark, no extra logos, no random text.
Prompt 1 — multi-shot product unbox (copy-paste)
Vertical 9:16 product ad, about 10 seconds, clean desk daylight.
Shot 1 wide: sealed matte white product box on oak table, soft window light.
Shot 2 medium: hands open the box lid smoothly, tissue paper folds clearly.
Shot 3 close-up: wireless earbuds lift toward camera, subtle specular highlight.
Same hands, same box branding color, continuous desk environment.
Soft paper rustle and light whoosh SFX, no music bed, no on-screen text, no watermark.
Prompt 2 — multi-shot dialogue beat
Horizontal short scene, about 12 seconds, warm kitchen night.
Shot 1 medium two-shot: two friends at a small table, tea cups, fairy lights bokeh.
Shot 2 over-shoulder: person A speaks with natural lip motion, soft smile.
Shot 3 reaction close-up: person B laughs, eyes crinkle, steam rises from cup.
Same wardrobe and hairstyles across all shots, consistent table props.
Quiet room tone plus light cup clink SFX; dialogue energy, no loud score, no subtitles, no watermark.
Prompt 3 — multi-shot outdoor action (simple)
Horizontal action clip, about 8 seconds, golden hour park path.
Shot 1 wide tracking: runner in red jacket jogs toward camera on gravel path.
Shot 2 side medium: arms and jacket fabric motion, trees streak softly.
Shot 3 low angle hero: runner passes, dust motes in sunbeams.
Same red jacket and black shorts throughout.
Footsteps and light wind ambience, no music, no text, no watermark.

Prompt-first motion language · showcase keyframe на FLUX 3 · generated-style still для планирования, не graded film still
Шаг 3 — Добавляйте native audio намеренно
Публичная история FLUX 3 включает native audio вместе с video (BFL; The Decoder). Относитесь к audio как к direction line, а не afterthought:
| Intent | Пример строки | | --- | --- | | Только ambience | “city night ambience and light rain, no music, no dialogue” | | SFX hit | “soft whoosh on logo settle, no voiceover” | | Dialogue energy | “natural conversational speech, quiet room tone, no score” | | Silence | “no music, no SFX, no dialogue—picture only” |
Lipsync tip: поместите говорящее лицо в close или medium shot и явно скажите “natural lip motion” (Prompt 2). Full-body extreme wide shots усложняют оценку рта.
Шаг 4 — Text to video vs image to video
| Стартовать с | Когда использовать | Путь | | --- | --- | --- | | Text to video | Вы изобретаете всю сцену | Video generator | | Image to video | Уже есть product photo, character frame или poster | Та же video page; optional still с image |
Image-to-video recipe: держите still простым (one subject, clear edges), затем промпьте только motion + camera + audio — не переописывайте другой outfit.
Image-to-video, 6 seconds, gentle push-in.
Preserve the exact product, colors, and logo from the reference still.
Soft studio light consistency, subtle rotation of the product, clean background.
Soft whoosh SFX, no new text, no watermark.
Шаг 5 — Pass/fail чеклист (full-screen)
Посмотрите один раз без scrubbing, затем scrub:
- Cut logic — читаются ли Shot 1→2→3 как intentional?
- Identity — same face, hair, wardrobe across cuts?
- Hands / props — extra fingers, melting boxes, sliding labels?
- Audio fit — звук совпадает с событиями (или вы просили silence)?
- Crop — faces и product safe для 9:16?
- Text pollution — random glyphs или watermarks?
Если два пункта fail, перепишите shot list, прежде чем сжигать больше runs. Обычно fix — shorter, clearer shots, а не больше adjectives.
Частые failure modes (и fixes)
| Симптом | Вероятная причина | Fix | | --- | --- | --- | | Один длинный continuous shot | Нет numbered shots | Добавьте explicit Shot 1/2/3 | | Character morphs between cuts | Vague wardrobe | Одно предложение, locking clothes/hair | | Busy audio | Conflicting music + dialogue + SFX | Выберите один audio priority | | Great face, bad product logo | Too much camera chaos | Slow push-in; fewer cuts | | Good 16:9, broken 9:16 | No aspect in prompt | Укажите vertical 9:16 + center subject |
Как прогнать 3-шаговый evaluate loop на FLUX 3
- Откройте FLUX 3 video.
- Вставьте Prompt 1 (или ваш real brief по skeleton).
- Оцените по pass/fail list → save keeper → optional image-to-video polish из still на image.
FAQ
Чем FLUX 3 video отличается для prompting?
Публичные creator notes подчёркивают multi-shot control из одного промпта и сильнее micro-detail (venturetwins; запуск BFL). Пишите cuts, а не только moods.
Какой длины делать первый FLUX 3 clip?
Публичные материалы обсуждают генерации до примерно 20 секунд (The Decoder). Чтобы учить multi-shot, стартуйте около 8–12 секунд, чтобы каждый beat оставался readable.
Сколько shots запрашивать?
Два–четыре для first drafts. Больше shots повышают continuity risk, пока у вас нет stable character line.
Может ли FLUX 3 делать native audio и lipsync?
Native audio — часть официальной multimodal story (BFL; The Decoder). Community demos также выделяют lip motion — всегда слушайте и zoom свои takes.
Text to video или image to video?
Text to video для invented scenes; image to video, когда brand stills уже есть. Оба — на video generator.
Нужна ли image page?
Только если хотите controlled still сначала. Генерируйте на image, затем анимируйте на video.
Почему multi-shot схлопывается в один continuous take?
В промпте, скорее всего, нет numbered shots и camera sizes. Используйте skeleton из Шага 2.
Можно ли запретить music?
Да — скажите “no music bed” или “picture only, no SFX” в audio line.
Где попробовать бесплатно?
Откройте FLUX 3 video на flux3.video и начните бесплатно — карта не нужна, чтобы стартовать.
Что читать дальше?
Обзор релиза: Что такое FLUX 3?.
Об Reese Okada
Reese Okada — AI video workflow writer, который превращает multi-shot промпты в повторяемые browser workflows на FLUX 3.
