Pada 23 Juli 2026, Black Forest Labs memperkenalkan FLUX 3—model frontier multimodal yang diposisikan sebagai satu sistem untuk gambar, video, audio, dan prediksi aksi, bukan kumpulan alat terpisah yang disatukan di belakang UI yang sama (utas pengumuman resmi; blog BFL; halaman model BFL).
Cerita publiknya sederhana: pelatihan bersama lintas modalitas agar hasil generate terasa lebih dekat ke kehidupan nyata di berbagai gaya—termasuk tampilan sehari-hari yang tidak sinematik (posting peluncuran BFL; Business Wire / Markets Insider).
Artikel ini adalah peta rilis untuk kreator: apa yang benar-benar diklaim materi resmi, kemampuan video mana yang penting lebih dulu (durasi, multi-shot, audio native), dan cara coba FLUX 3 gratis di browser di flux3.video. Untuk alur kerja multi-shot yang praktis, baca panduan pendamping: FLUX 3 Video: Multi-Shot, Klip ~20 dtk & Audio Native.
Ringkasan
FLUX 3 adalah model fondasi multimodal Black Forest Labs tanggal 23 Juli 2026. Posisi resmi: satu arsitektur yang belajar bersama dari gambar, video, dan audio, plus jalur prediksi aksi untuk mitra robotika (blog BFL; model BFL). Sorotan video publik mencakup klip hingga sekitar 20 detik, rangkaian multi-shot dari satu prompt, dan audio native (efek suara, ambiens, dialog) (ringkasan The Decoder atas materi BFL; catatan akses awal dari Justine Moore / a16z). Di FLUX 3 (situs ini), buka generator video atau generator gambar dan mulai gratis—tanpa kartu untuk mencoba.
Poin utama
- Tanggal rilis: 23 Juli 2026 untuk peluncuran publik FLUX 3 (@bfl_ai; bfl.ai/blog/flux-3).
- Cakupan: Gambar + Video + Audio + Prediksi aksi dalam satu desain multimodal (model BFL; rilis wire).
- Fitur video yang jadi headline: generate hingga ~20 dtk, multi-shot dari satu prompt, audio native (The Decoder; catatan awal venturetwins).
- Konteks seri: FLUX.1 (era gambar 2024) → FLUX.2 gambar/editing (November 2025) → FLUX 3 model multimodal dunia nyata (posting BFL FLUX.2; posting BFL FLUX 3).
- Jalur coba di sini: video FLUX 3 (default untuk klip pendek) dan gambar FLUX 3 di ruang kerja produk yang sama.
Apa yang benar-benar dirilis
1. Pitch multimodal yang menyatu—bukan “video yang ditempel ke gambar”
Black Forest Labs menggambarkan FLUX 3 sebagai belajar bersama dari gambar, video, dan audio di dalam arsitektur terpadu, karena tidak ada satu modalitas pun yang menangkap dunia sendirian (blog BFL; The Decoder). Perusahaan membingkai ini sebagai langkah menuju kecerdasan visual dunia nyata—model yang mempersepsi, memprediksi, dan (lewat mitra) bertindak (utas pengumuman BFL).

Bahasa still dari sehari-hari sampai sinematik · frame gaya showcase di FLUX 3
2. Video: durasi, multi-shot, audio native
Materi publik dan liputan minggu peluncuran menekankan:
| Kapabilitas | Klaim publik | Sumber utama | | --- | --- | --- | | Durasi | Klip video hingga sekitar 20 detik | The Decoder; CryptoBriefing | | Multi-shot | Beberapa shot / sudut dari satu prompt | Justine Moore (a16z) | | Audio native | Suara yang selaras dengan klip (SFX, ambiens, jalur dialog) | Pembingkaian peluncuran BFL; The Decoder | | Antarmuka | Teks ke video, gambar ke video, dan alur video terkait dalam narasi publik | The Decoder; jalur produk di generator video situs ini |
Tabel preferensi awal yang terbit di liputan peluncuran (misalnya perbandingan 720p singkat vs sistem video lain) adalah sinyal awal yang dilaporkan vendor, bukan sertifikasi industri film yang independen (ringkasan grafik The Decoder). Pakai sebagai konteks, lalu nilai prompt kamu sendiri.

Bahasa gerak yang berangkat dari prompt · keyframe showcase di FLUX 3
3. Jalur gambar dalam keluarga yang sama
Posting resmi menampilkan sampel FLUX 3 Image dan menggambarkan sintesis/editing lintas gaya, rasio aspek, dan resolusi sebagai bagian dari sistem multimodal (sampel PS di utas BFL; blog BFL). Di produk ini, gambar diam ada di generator gambar dengan FLUX 3 sebagai default gambar situs.
4. Aksi / robotika (konteks, bukan CTA kreator utama)
BFL juga mengumumkan kerja FLUX-mimic bersama Mimic Robotics, termasuk narasi uji industri yang melibatkan Audi (posting aksi BFL di utas peluncuran; rilis wire). Itu penting untuk cerita “model dunia”. Untuk iklan sosial, demo produk, dan film pendek, permukaan praktisnya tetap generate video + gambar.
5. Linimasa seri (FLUX → FLUX.2 → FLUX 3)
| Generasi | Tema publik | Acuan | | --- | --- | --- | | Era FLUX.1 | Gelombang generate gambar terbuka yang membuat FLUX jadi default kreator | Riwayat seri di BFL / ikhtisar Wikipedia | | FLUX.2 | Generate & editing gambar produksi (multi-referensi, fidelitas lebih tinggi) | Blog FLUX.2, 25 November 2025 | | FLUX 3 | Tulang punggung multimodal video + audio + gambar | Blog FLUX 3, 23 Juli 2026 |
Pendalaman: untuk siapa FLUX 3
Pemasar sosial dan UGC
Klip pendek yang menahan wajah, gerakan, dan cahaya sehari-hari—tanpa menyewa satu hari produksi penuh—adalah pekerjaan yang dimungkinkan multi-shot + audio native. Mulai di teks ke video.
Tim produk dan growth
Gambar ke video mengubah still kemasan atau frame produk hero menjadi iklan gerak putaran pertama. Pakai still yang bersih, lalu animasikan di ruang kerja video yang sama.
Pembuat film AI dan storyboarder
Multi-shot dari satu prompt adalah pembeda yang terus diposting kreator di minggu peluncuran (venturetwins). Perlakukan output awal sebagai putaran pertama yang bisa diedit, lalu rapikan prompt shot demi shot.
Desainer still yang sudah hidup di FLUX
Kalau kamu mengenal FLUX untuk gambar diam, cerita publik FLUX 3 adalah “keluarga yang sama, sekarang ada waktu + suara.” Tetap di gambar untuk still dan di video untuk gerak.
Yang kita tahu vs. yang tidak kita klaim
| Kita tahu (bersumber) | Kita tidak tahu / tidak akan klaim | | --- | --- | | Peluncuran publik 23 Juli 2026 dengan posisi multimodal (@bfl_ai; blog BFL) | Bahwa setiap host, resolusi, atau pengalih durasi identik di semua produk di seluruh dunia | | Narasi video mencakup ~20 dtk, multi-shot, audio native (The Decoder) | Kesempurnaan take pertama yang dijamin untuk setiap wajah, tangan, dan putaran tubuh penuh | | Skor preferensi awal ada di liputan peluncuran dan bersifat pendahuluan (The Decoder) | Papan peringkat independen yang diulas sejawat dan menobatkan “model video #1” permanen | | FLUX.2 menetapkan bab gambar yang kuat (BFL FLUX.2) | Bahwa still dan video selalu berbagi gaya visual yang persis sama di setiap seed | | Situs ini menampilkan generator browser video dan gambar untuk alur FLUX 3 | Tabel harga dolar-per-detik lintas vendor (tidak dibandingkan di sini) |
Mengapa ini penting bagi pembangun
- Video + audio dalam satu generate mengurangi lompat-alat untuk iklan dan explainer putaran pertama.
- Prompt multi-shot mengubah cara kamu menulis arahan—tulis potongan shot, bukan hanya suasana (catatan awal multi-shot).
- Kesinambungan merek FLUX membantu tim yang sudah prompting dalam bahasa still FLUX memindahkan kerja gerak tanpa model mental baru.
- Jalur coba di browser lebih cepat daripada menunggu instalasi lokal yang sempurna saat kamu hanya perlu tahu apakah shot produkmu bertahan saat bergerak.
Cara menilai FLUX 3 sendiri di situs ini
- Buka generator video FLUX 3.
- Tempel Prompt A di bawah (multi-shot).
- Tonton sekali layar penuh: wajah, kejelasan potongan, kecocokan audio (jika ada), dan crop 9:16 tidak memotong subjek.
- Simpan yang lolos; putaran kedua opsional dengan gambar ke video dari still yang sudah kamu suka di gambar.
Prompt A — joust di halaman belakang, multi-shot
Multi-shot short film, 12 seconds, playful daylight backyard.
Shot 1 wide: two kids jousting with bright pool noodles, green grass, summer sun.
Shot 2 medium: slow motion near-miss as noodles clash, fabric and hair motion clear.
Shot 3 close-up: both kids laughing, natural faces, soft bokeh fence in background.
Natural ambient audio feel, no music bed, no text overlays, no watermark.
Prompt B — putaran hero produk
Product commercial, 8 seconds, clean studio.
Shot 1: matte black wireless earbuds case on white seamless, soft key light.
Shot 2: lid opens smoothly, earbuds catch a specular highlight.
Shot 3: earbud floats closer to camera, macro detail on mesh.
Subtle whoosh SFX energy, no logos other than the product shape, no watermark.
Prompt C — jalan neon hujan (suasana)
Cinematic street clip, 10 seconds, night rain, neon reflections.
Single continuous push-in toward a woman laughing under a translucent umbrella,
wet asphalt, cyan and magenta signs, handheld micro-motion, natural skin texture.
City ambience and light rain SFX, no dialogue, no on-screen text, no watermark.
Apa yang perlu diawasi berikutnya
- Resep multi-shot kreator (daftar shot sebagai prompt)—lihat panduan multi-shot.
- Alur gambar untuk still yang memberi makan gambar ke video (generator gambar).
- Catatan riset resmi BFL tentang Self-Flow / tulang punggung multimodal seiring mereka menerbitkan lebih banyak (hub riset BFL lewat ringkasan arsitektur The Decoder).
FAQ
Apa itu FLUX 3?
FLUX 3 adalah model fondasi multimodal Black Forest Labs tanggal 23 Juli 2026 untuk gambar, video, audio, dan prediksi aksi, dilatih bersama bukan sebagai model tujuan tunggal yang terpisah (blog BFL; utas peluncuran).
Apakah FLUX 3 hanya model video?
Tidak. Materi publik menggambarkan jalur video, gambar, audio, dan aksi dalam satu desain multimodal (model BFL). Di situs ini kamu bisa mulai dengan video atau gambar.
Berapa lama video FLUX 3 bisa?
Liputan peluncuran menyebut klip hingga sekitar 20 detik dalam narasi publik BFL (The Decoder). Selalu konfirmasi kontrol durasi yang tersedia di UI generator untuk jalankanmu.
Apakah FLUX 3 mendukung multi-shot dalam satu prompt?
Ya—itu sorotan kreator di minggu peluncuran: beberapa shot dari satu prompt (venturetwins). Tulis baris Shot 1 / Shot 2 / Shot 3 secara eksplisit untuk kontrol terbaik.
Apa itu audio native di FLUX 3?
Audio native berarti model bisa menghasilkan suara bersama video—ambiens, SFX, dan demo berorientasi dialog muncul di liputan publik (The Decoder; peluncuran BFL).
Apa bedanya FLUX 3 dengan FLUX.2?
FLUX.2 (November 2025) adalah bab generate & editing gambar produksi (BFL FLUX.2). FLUX 3 memperluas keluarga menjadi sistem multimodal dengan penceritaan video + audio sebagai kemampuan utama (BFL FLUX 3).
Bisa coba FLUX 3 gratis online?
Ya. Buka generator video FLUX 3 di flux3.video untuk mulai gratis—tanpa kartu untuk memulai. Gambar diam: generator gambar.
Teks ke video atau gambar ke video—yang mana dulu?
Pakai teks ke video saat kamu menciptakan adegan dari nol. Pakai gambar ke video saat kamu sudah punya foto produk atau still karakter yang ingin dianimasikan—keduanya ada di video.
Apakah perbandingan win-rate yang terbit sudah final?
Tidak. Tingkat preferensi awal di artikel peluncuran adalah sinyal pendahuluan yang dilaporkan vendor dalam kondisi uji tertentu (The Decoder). Jalankan prompt kamu sendiri untuk keputusan yang penting.
Harus mulai dari mana sekarang?
Tempel Prompt A ke generator video, tonton sekali layar penuh, lalu iterasi deskripsi shot—bukan hanya kata sifat.
Tentang Avery Lin
Avery Lin adalah analis rilis model AI yang mengikuti peluncuran keluarga FLUX dan mengubah fakta model publik menjadi jalur coba yang jelas bagi kreator di FLUX 3.
