Ngày 23 tháng 7 năm 2026, Black Forest Labs giới thiệu FLUX 3—một mô hình frontier đa phương thức, được định vị là một hệ thống cho ảnh, video, audio và dự đoán hành động, chứ không phải một đống công cụ rời ghép sau cùng một giao diện (thread công bố chính thức; blog BFL; trang mô hình BFL).
Câu chuyện công khai rất thẳng: huấn luyện chung trên các phương thức để kết quả gần đời thực hơn—kể cả phong cách đời thường, không điện ảnh (bài ra mắt BFL; Business Wire / Markets Insider).
Bài này là bản đồ ra mắt cho creator: tài liệu chính thức thực sự khẳng định gì, khả năng video nào đáng quan tâm trước (độ dài, nhiều shot, âm thanh gốc), và cách thử FLUX 3 miễn phí trên trình duyệt tại flux3.video. Để làm quy trình nhiều shot thực tế, đọc hướng dẫn đi kèm: FLUX 3 Video: nhiều shot, clip ~20 giây & âm thanh gốc.
Tóm tắt
FLUX 3 là mô hình nền tảng đa phương thức của Black Forest Labs ngày 23 tháng 7 năm 2026. Định vị chính thức: một kiến trúc học chung từ ảnh, video và audio, kèm đường dự đoán hành động cho đối tác robot (blog BFL; mô hình BFL). Điểm nổi bật video công khai gồm clip dài tới khoảng 20 giây, chuỗi nhiều shot từ một prompt, và âm thanh gốc (hiệu ứng, không khí, thoại) (The Decoder tóm tắt tài liệu BFL; ghi chú truy cập sớm từ Justine Moore / a16z). Trên FLUX 3 (site này), mở trình tạo video hoặc trình tạo ảnh và bắt đầu miễn phí—không cần thẻ để thử.
Điểm chính
- Ngày ra mắt: 23 tháng 7 năm 2026 cho lần công bố FLUX 3 công khai (@bfl_ai; bfl.ai/blog/flux-3).
- Phạm vi: Ảnh + Video + Audio + dự đoán hành động dưới một thiết kế đa phương thức (mô hình BFL; bản tin wire).
- Headline video: tạo tới ~20 giây, nhiều shot từ một prompt, âm thanh gốc (The Decoder; ghi chú sớm của venturetwins).
- Bối cảnh series: FLUX.1 (kỷ nguyên ảnh 2024) → FLUX.2 ảnh/chỉnh sửa (tháng 11 năm 2025) → FLUX 3 mô hình đa phương thức cho thế giới thực (bài BFL FLUX.2; bài BFL FLUX 3).
- Đường thử tại đây: video FLUX 3 (mặc định cho clip ngắn) và ảnh FLUX 3 trong cùng không gian sản phẩm.
Thực sự đã ra mắt những gì
1. Một định vị đa phương thức thống nhất—không phải “video gắn thêm vào ảnh”
Black Forest Labs mô tả FLUX 3 là học chung từ ảnh, video và audio trong một kiến trúc thống nhất, vì không phương thức nào một mình nắm được thế giới (blog BFL; The Decoder). Công ty đặt đây là bước tới trí tuệ thị giác thế giới thực—mô hình nhận biết, dự đoán, và (qua đối tác) hành động (thread công bố BFL).

Ngôn ngữ still từ đời thường tới điện ảnh · khung showcase trên FLUX 3
2. Video: độ dài, nhiều shot, âm thanh gốc
Tài liệu công khai và báo chí tuần ra mắt nhấn:
| Khả năng | Công bố công khai | Nguồn chính | | --- | --- | --- | | Thời lượng | Clip video dài tới khoảng 20 giây | The Decoder; CryptoBriefing | | Nhiều shot | Nhiều shot / góc máy từ một prompt | Justine Moore (a16z) | | Âm thanh gốc | Âm thanh khớp clip (SFX, không khí, đường thoại) | định vị ra mắt BFL; The Decoder | | Giao diện | Văn bản thành video, ảnh thành video, và quy trình video liên quan trong câu chuyện công khai | The Decoder; đường sản phẩm trên trình tạo video của site này |
Bảng preference sớm đăng trong coverage ra mắt (ví dụ so sánh 720p ngắn với hệ video khác) là tín hiệu sớm do vendor báo cáo, không phải chứng nhận độc lập của ngành phim (The Decoder tóm tắt biểu đồ). Dùng làm bối cảnh, rồi tự chấm prompt của bạn.

Ngôn ngữ chuyển động đi từ prompt · keyframe showcase trên FLUX 3
3. Đường ảnh trong cùng họ
Bài chính thức cho thấy mẫu FLUX 3 Image và mô tả tổng hợp/chỉnh sửa trên nhiều phong cách, tỷ lệ khung và độ phân giải như một phần của hệ đa phương thức (mẫu PS trên thread BFL; blog BFL). Trên sản phẩm này, ảnh tĩnh nằm ở trình tạo ảnh với FLUX 3 là mặc định ảnh của nhà.
4. Hành động / robot (bối cảnh, không phải CTA chính cho creator)
BFL cũng công bố công việc FLUX-mimic với Mimic Robotics, gồm các câu chuyện thử nghiệm công nghiệp liên quan Audi (bài hành động trong thread ra mắt BFL; bản tin wire). Điều đó quan trọng cho câu chuyện “world model”. Với quảng cáo mạng xã hội, demo sản phẩm và phim ngắn, mặt dùng thực tế vẫn là tạo video + ảnh.
5. Dòng thời gian series (FLUX → FLUX.2 → FLUX 3)
| Thế hệ | Chủ đề công khai | Neo | | --- | --- | --- | | Kỷ nguyên FLUX.1 | Sóng tạo ảnh mở/ảnh khiến FLUX thành mặc định của creator | Lịch sử series trên BFL / tổng quan Wikipedia | | FLUX.2 | Tạo và chỉnh ảnh production (đa tham chiếu, độ trung thực cao hơn) | Blog FLUX.2, 25 tháng 11 năm 2025 | | FLUX 3 | Xương sống đa phương thức video + audio + ảnh | Blog FLUX 3, 23 tháng 7 năm 2026 |
Đào sâu: FLUX 3 dành cho ai
Marketer social và UGC
Clip ngắn giữ được khuôn mặt, chuyển động và ánh sáng đời thường—mà không thuê cả một ngày sản xuất—là việc mà nhiều shot + âm thanh gốc mở ra. Bắt đầu từ văn bản thành video.
Đội sản phẩm và tăng trưởng
Ảnh thành video biến still bao bì hoặc khung sản phẩm hero thành quảng cáo chuyển động vòng đầu. Dùng still sạch, rồi animate trên cùng không gian video.
Nhà làm phim AI và storyboard
Nhiều shot từ một prompt là điểm khác biệt mà creator tuần ra mắt liên tục đăng (venturetwins). Coi output sớm là bản nháp có thể chỉnh, rồi tinh prompt từng shot.
Designer ảnh tĩnh vốn đã làm việc trên FLUX
Nếu bạn biết FLUX vì ảnh tĩnh, câu chuyện công khai của FLUX 3 là “cùng họ, giờ thêm thời gian + âm thanh.” Giữ ảnh tĩnh trên ảnh và chuyển động trên video.
Điều chúng ta biết và điều chúng ta không biết
| Chúng ta biết (có nguồn) | Chúng ta không biết / sẽ không khẳng định | | --- | --- | | Ra mắt công khai 23 tháng 7 năm 2026 với định vị đa phương thức (@bfl_ai; blog BFL) | Mọi host, độ phân giải hay nút thời lượng đều giống hệt trên mọi sản phẩm toàn cầu | | Câu chuyện video gồm ~20 giây, nhiều shot, âm thanh gốc (The Decoder) | Take đầu luôn hoàn hảo cho mọi khuôn mặt, bàn tay và vòng xoay toàn thân | | Điểm preference sớm tồn tại trong coverage ra mắt và mang tính sơ bộ (The Decoder) | Bảng xếp hạng độc lập, peer-review phong “mô hình video số 1” vĩnh viễn | | FLUX.2 đã lập một chương ảnh mạnh (BFL FLUX.2) | Ảnh tĩnh và video luôn cùng một dấu ấn thẩm mỹ trên mọi seed | | Site này mở trình tạo video và ảnh trên trình duyệt cho quy trình FLUX 3 | Bảng giá đô-la-mỗi-giây xuyên vendor (không so ở đây) |
Vì sao điều này quan trọng với người làm sản phẩm
- Video + audio trong một lần tạo giảm nhảy công cụ cho quảng cáo và explainer vòng đầu.
- Prompt nhiều shot đổi cách bạn viết mô tả—viết cắt cảnh, không chỉ mood (ghi chú sớm về nhiều shot).
- Liên tục thương hiệu FLUX giúp đội đã prompt bằng ngôn ngữ ảnh tĩnh FLUX chuyển việc chuyển động mà không cần mô hình tư duy mới.
- Đường thử trên trình duyệt hơn việc chờ cài local hoàn hảo khi bạn chỉ cần biết shot sản phẩm của bạn còn dùng được khi có chuyển động không.
Cách tự đánh giá FLUX 3 trên site này
- Mở trình tạo video FLUX 3.
- Dán Prompt A bên dưới (nhiều shot).
- Xem một lần full màn hình: khuôn mặt, độ rõ của cắt, khớp audio (nếu có), và 9:16 crop không cắt mất chủ thể.
- Lưu take đạt; vòng hai tùy chọn với ảnh thành video từ still bạn đã thích trên ảnh.
Prompt A — đấu kiếm sân sau nhiều shot
Multi-shot short film, 12 seconds, playful daylight backyard.
Shot 1 wide: two kids jousting with bright pool noodles, green grass, summer sun.
Shot 2 medium: slow motion near-miss as noodles clash, fabric and hair motion clear.
Shot 3 close-up: both kids laughing, natural faces, soft bokeh fence in background.
Natural ambient audio feel, no music bed, no text overlays, no watermark.
Prompt B — xoay hero sản phẩm
Product commercial, 8 seconds, clean studio.
Shot 1: matte black wireless earbuds case on white seamless, soft key light.
Shot 2: lid opens smoothly, earbuds catch a specular highlight.
Shot 3: earbud floats closer to camera, macro detail on mesh.
Subtle whoosh SFX energy, no logos other than the product shape, no watermark.
Prompt C — phố neon mưa (mood)
Cinematic street clip, 10 seconds, night rain, neon reflections.
Single continuous push-in toward a woman laughing under a translucent umbrella,
wet asphalt, cyan and magenta signs, handheld micro-motion, natural skin texture.
City ambience and light rain SFX, no dialogue, no on-screen text, no watermark.
Nên theo dõi tiếp
- Công thức nhiều shot cho creator (danh sách shot viết thành prompt)—xem hướng dẫn nhiều shot.
- Workflow ảnh cho still nuôi ảnh thành video (trình tạo ảnh).
- Ghi chú nghiên cứu chính thức của BFL về Self-Flow / xương sống đa phương thức khi họ công bố thêm (hub nghiên cứu BFL qua tóm tắt kiến trúc của The Decoder).
Câu hỏi thường gặp
FLUX 3 là gì?
FLUX 3 là mô hình nền tảng đa phương thức của Black Forest Labs ngày 23 tháng 7 năm 2026 cho ảnh, video, audio và dự đoán hành động, huấn luyện chung chứ không phải các mô hình đơn năng rời (blog BFL; thread ra mắt).
FLUX 3 chỉ là mô hình video thôi sao?
Không. Tài liệu công khai mô tả đường video, ảnh, audio và hành động dưới một thiết kế đa phương thức (mô hình BFL). Trên site này bạn có thể bắt đầu bằng video hoặc ảnh.
Video FLUX 3 dài được bao lâu?
Báo chí ra mắt trích clip tới khoảng 20 giây trong câu chuyện công khai của BFL (The Decoder). Luôn xác nhận nút thời lượng có trên UI trình tạo cho lần chạy của bạn.
FLUX 3 có hỗ trợ nhiều shot trong một prompt không?
Có—đó là điểm creator tuần ra mắt hay nhắc: nhiều shot từ một prompt (venturetwins). Viết rõ dòng Shot 1 / Shot 2 / Shot 3 để kiểm soát tốt hơn.
Âm thanh gốc trong FLUX 3 là gì?
Âm thanh gốc nghĩa là mô hình có thể tạo âm thanh cùng video—không khí, SFX, và demo hướng thoại xuất hiện trong coverage công khai (The Decoder; ra mắt BFL).
FLUX 3 khác FLUX.2 thế nào?
FLUX.2 (tháng 11 năm 2025) là chương tạo và chỉnh ảnh production (BFL FLUX.2). FLUX 3 mở rộng họ thành hệ đa phương thức với kể chuyện video + audio là năng lực chính (BFL FLUX 3).
Tôi có thể thử FLUX 3 miễn phí trực tuyến không?
Có. Mở trình tạo video FLUX 3 trên flux3.video để bắt đầu miễn phí—không cần thẻ để bắt đầu. Ảnh tĩnh: trình tạo ảnh.
Văn bản thành video hay ảnh thành video—cái nào trước?
Dùng văn bản thành video khi nghĩ ra cảnh từ đầu. Dùng ảnh thành video khi đã có ảnh sản phẩm hoặc still nhân vật muốn animate—cả hai nằm dưới video.
So sánh win-rate đã công bố có phải chốt hạ không?
Không. Tỷ lệ preference sớm trong bài ra mắt là tín hiệu sơ bộ do vendor báo cáo trong điều kiện test cụ thể (The Decoder). Chạy prompt của bạn cho quyết định quan trọng.
Tôi nên bắt đầu ngay bây giờ ở đâu?
Dán Prompt A vào trình tạo video, xem full màn hình một lần, rồi chỉnh mô tả shot—không chỉ tính từ.
Về Avery Lin
Avery Lin là nhà phân tích ra mắt mô hình AI, theo dõi các lần launch họ FLUX và biến sự kiện mô hình công khai thành đường thử rõ cho creator trên FLUX 3.
