TLDR
FLUX 3 — мультимодальная foundation-модель Black Forest Labs от 23 июля 2026. Официальное позиционирование: одна архитектура, совместно обучающаяся на изображениях, видео и аудио, с веткой action-prediction для robotics-партнёров (блог BFL; модели BFL). Публичные видео-акценты: клипы до ~20 секунд, multi-shot последовательности из одного промпта и native audio (звуковые эффекты, атмосфера, диалог) (сводка The Decoder по материалам BFL; ранние заметки Justine Moore / a16z). На FLUX 3 (этот сайт) откройте видеогенератор или генератор изображений и начните бесплатно — карта не нужна, чтобы попробовать.
Ключевые выводы
- Дата релиза: 23 июля 2026 — публичный запуск FLUX 3 (@bfl_ai; bfl.ai/blog/flux-3).
- Охват: Image + Video + Audio + Action-Prediction в рамках одной мультимодальной конструкции (модели BFL; wire-релиз).
- Главные видео-фичи: до ~20 с генерации, multi-shot из одного промпта, native audio (The Decoder; ранние заметки venturetwins).
- Контекст серии: FLUX.1 (эра изображений 2024) → FLUX.2 image/editing (ноябрь 2025) → FLUX 3 мультимодальные real-world модели (пост BFL о FLUX.2; пост BFL о FLUX 3).
- Путь пробы здесь: FLUX 3 video (по умолчанию для коротких клипов) и FLUX 3 image в одном продуктовом workspace.
Что реально вышло
1. Единый мультимодальный pitch — не «видео, прикрученное к картинке»
Black Forest Labs описывает FLUX 3 как совместное обучение на изображениях, видео и аудио внутри единой архитектуры, потому что ни одна модальность сама по себе не описывает мир (блог BFL; The Decoder). Компания подаёт это как шаг к real-world visual intelligence — моделям, которые воспринимают, предсказывают и (через партнёров) действуют (анонс-тред BFL).

От повседневного до кинематографичного still-языка · showcase-кадр на FLUX 3
2. Видео: длина, multi-shot, native audio
Публичные материалы и репортажи недели запуска подчёркивают:
| Возможность | Публичное заявление | Основные источники | | --- | --- | --- | | Длительность | Видеоклипы до примерно 20 секунд | The Decoder; CryptoBriefing | | Multi-shot | Несколько планов / ракурсов из одного промпта | Justine Moore (a16z) | | Native audio | Звук, согласованный с клипом (SFX, ambient, dialogue-пути) | Фрейминг запуска BFL; The Decoder | | Интерфейсы | Text-to-video, image-to-video и смежные видео-workflow в публичной нарративе | The Decoder; продуктовый путь на видеогенераторе этого сайта |
Ранние таблицы предпочтений в обзорах запуска (например, короткие сравнения 720p с другими видеосистемами) — это vendor-reported early signals, а не независимые киноиндустриальные сертификации (сводка чарта The Decoder). Используйте их как контекст, а затем судите по своим промптам.

Prompt-first motion language · showcase keyframe на FLUX 3
3. Image-путь в том же семействе
Официальные посты показывают сэмплы FLUX 3 Image и описывают синтез/редактирование по стилям, aspect ratio и разрешениям как часть мультимодального стека (PS-сэмплы в треде BFL; блог BFL). В этом продукте stills живут на генераторе изображений; FLUX 3 — дефолт для house image.
4. Action / robotics (контекст, не главный creator CTA)
BFL также анонсировала работу FLUX-mimic с Mimic Robotics, включая индустриальные тесты с участием Audi (action-пост в launch-треде BFL; wire-релиз). Это важно для истории «world model». Для social ads, product demos и коротких фильмов практическая поверхность по-прежнему — генерация video + image.
5. Таймлайн серии (FLUX → FLUX.2 → FLUX 3)
| Поколение | Публичная тема | Якорь | | --- | --- | --- | | Эра FLUX.1 | Волна open/image generation, сделавшая FLUX дефолтом для авторов | История серии на BFL / обзор Wikipedia | | FLUX.2 | Production image generation & editing (multi-reference, выше fidelity) | Блог FLUX.2, 25 ноября 2025 | | FLUX 3 | Мультимодальный backbone video + audio + image | Блог FLUX 3, 23 июля 2026 |
Deep dive: для кого FLUX 3
Social- и UGC-маркетологи
Короткие клипы, которые держат лица, движение и повседневный свет — без полного production day — как раз то, что открывают multi-shot + native audio. Начните с text to video.
Product- и growth-команды
Image-to-video превращает packaging still или hero product frame в first-pass motion ad. Возьмите чистый still, затем анимируйте в том же video workspace.
AI-режиссёры и storyboarders
One-prompt multi-shot — дифференциатор, о котором авторы launch-week пишут чаще всего (venturetwins). Ранние выходы трактуйте как редактируемые first pass, затем уточняйте промпты shot-by-shot.
Still-дизайнеры, уже живущие во FLUX
Если вы знаете FLUX по stills, публичная история FLUX 3 — «то же семейство, теперь time + sound». Stills — на image, motion — на video.
Что мы знаем vs. чего не знаем
| Мы знаем (с источниками) | Не знаем / не утверждаем | | --- | --- | | Публичный запуск 23 июля 2026 с мультимодальным позиционированием (@bfl_ai; блог BFL) | Что каждый host, resolution или duration toggle идентичен во всех продуктах по миру | | Видео-нарратив включает ~20 с, multi-shot, native audio (The Decoder) | Гарантированное first-take perfection для каждого лица, руки и full-body поворота | | Ранние preference scores есть в launch-coverage и предварительны (The Decoder) | Независимые peer-reviewed leaderboard, навсегда коронующие «#1 video model» | | FLUX.2 закрепил сильную image-главу (BFL FLUX.2) | Что stills и video всегда делят ровно один aesthetic fingerprint на каждом seed | | Этот сайт даёт браузерные video и image генераторы для FLUX 3 workflow | Cross-vendor таблицы dollar-per-second (здесь не сравниваем) |
Почему это важно для builders
- Video + audio в одной генерации снижает tool-hopping для first-pass ads и explainers.
- Multi-shot prompting меняет, как вы пишете brief — пишите cuts, а не только vibes (ранние multi-shot заметки).
- Непрерывность бренда FLUX помогает командам, уже пишущим на языке FLUX stills, перенести motion-работу без новой mental model.
- Browser try paths лучше, чем ждать идеальный local install, когда нужно лишь понять, выдержит ли ваш product shot движение.
Как оценить FLUX 3 самому на этом сайте
- Откройте FLUX 3 video generator.
- Вставьте Prompt A ниже (multi-shot).
- Посмотрите один раз на full screen: лица, ясность cuts, audio fit (если есть) и crop survival для 9:16.
- Сохраните keepers; опциональный второй проход с image to video из still, который вам уже нравится, на image.
Prompt A — multi-shot backyard joust
Multi-shot short film, 12 seconds, playful daylight backyard.
Shot 1 wide: two kids jousting with bright pool noodles, green grass, summer sun.
Shot 2 medium: slow motion near-miss as noodles clash, fabric and hair motion clear.
Shot 3 close-up: both kids laughing, natural faces, soft bokeh fence in background.
Natural ambient audio feel, no music bed, no text overlays, no watermark.
Prompt B — product hero spin
Product commercial, 8 seconds, clean studio.
Shot 1: matte black wireless earbuds case on white seamless, soft key light.
Shot 2: lid opens smoothly, earbuds catch a specular highlight.
Shot 3: earbud floats closer to camera, macro detail on mesh.
Subtle whoosh SFX energy, no logos other than the product shape, no watermark.
Prompt C — rainy neon street (mood)
Cinematic street clip, 10 seconds, night rain, neon reflections.
Single continuous push-in toward a woman laughing under a translucent umbrella,
wet asphalt, cyan and magenta signs, handheld micro-motion, natural skin texture.
City ambience and light rain SFX, no dialogue, no on-screen text, no watermark.
Что смотреть дальше
- Creator multi-shot recipes (shot lists как промпты) — см. наш FLUX 3 Video: Multi-Shot, ~20s клипы и native audio.
- Image workflows для stills, которые питают image-to-video (генератор изображений).
- Официальные research notes BFL по Self-Flow / multimodal backbone по мере публикации (BFL research hub через architecture summary The Decoder).
FAQ
Что такое FLUX 3?
FLUX 3 — мультимодальная foundation-модель Black Forest Labs от 23 июля 2026 для image, video, audio и action-prediction, обученная совместно, а не как набор отдельных single-purpose моделей (блог BFL; launch-тред).
FLUX 3 — только видеомодель?
Нет. Публичные материалы описывают пути video, image, audio и action в одной мультимодальной конструкции (модели BFL). На этом сайте можно начать с video или image.
Какой длины могут быть видео FLUX 3?
Launch-reporting цитирует клипы до примерно 20 секунд в публичной нарративе BFL (The Decoder). Всегда сверяйте duration control, доступный в UI генератора для вашего прогона.
Поддерживает ли FLUX 3 multi-shot в одном промпте?
Да — это creator-highlight launch-week: несколько shots из одного промпта (venturetwins). Для лучшего контроля пишите явные строки Shot 1 / Shot 2 / Shot 3.
Что такое native audio в FLUX 3?
Native audio значит, что модель может производить звук вместе с видео — ambience, SFX и dialogue-oriented demos появляются в публичных обзорах (The Decoder; запуск BFL).
Чем FLUX 3 отличается от FLUX.2?
FLUX.2 (ноябрь 2025) — глава production image generation & editing (BFL FLUX.2). FLUX 3 расширяет семейство до мультимодального стека с first-class video + audio storytelling (BFL FLUX 3).
Можно ли бесплатно попробовать FLUX 3 онлайн?
Да. Откройте FLUX 3 video generator на flux3.video, чтобы начать бесплатно — карта не нужна, чтобы стартовать. Stills: image generator.
Text to video или image to video — что сначала?
Используйте text to video, когда изобретаете сцену с нуля. Используйте image to video, когда уже есть product photo или character still, который хотите анимировать — оба пути живут под video.
Финальны ли опубликованные win-rate сравнения?
Нет. Ранние preference rates в launch-статьях — предварительные vendor-reported signals при конкретных условиях теста (The Decoder). Для важных решений прогоняйте свои промпты.
С чего начать прямо сейчас?
Вставьте Prompt A в видеогенератор, один раз посмотрите full screen, затем итерируйте описания shots — а не только прилагательные.
Об Avery Lin
Avery Lin — аналитик релизов AI-моделей, который отслеживает запуски семейства FLUX и превращает публичные факты о моделях в понятные try paths для авторов на FLUX 3.
