Model video pertama Black Forest Labs: klip 20 detik dengan audio tersinkronisasi, hingga 10 keyframe yang disematkan, dan tampilan mulai dari live-action hingga stop-motion. Ketik prompt di bawah dan coba.
Pengembang
Black Forest Labs
Jenis
Multimodal (video sekarang, gambar segera)
Audio
Native, tersinkron, kata sandi yang sama
Durasi
Hingga 20 dtk per proses
Bingkai kunci
Hingga 10 disematkan + pertama/terakhir
Buka bobot
Pengembangan direncanakan, akhir 2026
Tingkat di sini
Kredit berbayar + mode draf
Putusan kami dalam satu baris: pilihan storyboard. Saat Anda tahu persis frame mana yang harus dicapai oleh shot — atau menginginkan tampilan yang bukan “video AI sinematik” — mulai dari sini.
FLUX 3 berasal dari lab Freiburg yang para pendirinya membangun arsitektur di balik Stable Diffusion, dan ini adalah model pertama mereka yang bergerak: satu jaringan yang dilatih bersama pada gambar, video, audio, dan aksi, dengan video diluncurkan terlebih dahulu. Dua hal membedakannya di bulan yang padat — Anda dapat menyematkan hingga sepuluh frame persis dan membiarkan model menganimasikan di antaranya, dan output tidak terkunci pada tampilan “AI cinematic” yang mengilap. Mentah, nostalgis, buatan tangan, aneh: rentangnya adalah intinya.
Kesan awal dari render uji kami plus materi yang dipublikasikan BFL — dengan catatan mereka sendiri disampaikan apa adanya. Kami akan merevisinya saat angka independen tersedia.
• Kontrol keyframe.
Sematkan hingga 10 frame persis ditambah frame pertama dan terakhir, dan model menghasilkan gerakan, kamera, dialog, dan audio di antaranya. Storyboard sebagai format input — tidak ada hal lain yang kami host yang menerima titik jangkar sebanyak ini.
• Rentang estetika.
Stop-motion, makro, time-lapse, video rumahan yang nostalgis, sengaja aneh — ini keluar dari kilau sinematik seragam yang secara default menjadi pilihan sebagian besar model video. Jika tampilan merek Anda bukan "trailer film", ini penting.
• Audio dalam pass yang sama.
Hingga 20 detik dengan soundtrack tersinkronisasi — termasuk dialog — dan ekstensi yang menyadari sambungan, yang membawa gerakan, kamera, dan audio melewati titik sambung saat Anda memperpanjang klip.
• Ekonomi mode draf.
Setiap endpoint memiliki varian draf cepat untuk pratinjau berbiaya rendah. Iterasikan pada draf, gunakan kredit sungguhan sekali saja pada versi final — alur kerja yang digaungkan seluruh situs ini, tertanam dalam keluarga model.
• Bagian gambar belum ada di sini.
Nama FLUX terkenal untuk gambar, tetapi pembuatan gambar FLUX 3 masih diluncurkan bertahap. Jika Anda datang ke sini untuk membuat gambar, itu masih beberapa minggu lagi — lihat FAQ sebelum Anda menghabiskan kredit untuk mengetahuinya.
• Benchmark adalah nomor rumah.
Bagan peluncuran diberi label sebagai evaluasi awal terhadap kandidat tahap awal, dan tingkat kemenangan yang paling mencolok diperoleh melawan model-model yang tidak menentukan laju saat ini. Klaim BFL yang belakangan lebih kuat, tetapi masih bersifat internal.
• 20 detik, bukan 30.
Wan 3.0 dan Seedance 2.5 sama-sama mencapai 30 dalam sekali proses. FLUX 3 menjawab dengan ekstensi yang menghormati sambungan — tetapi jika brief-nya adalah satu durasi setengah menit tanpa putus, itu bukan pilihan yang tepat.
• Bobot pengembangan: direncanakan, belum bertanggal.
Rilis dengan bobot terbuka diumumkan untuk nanti pada 2026, tanpa tanggal atau ketentuan lisensi. Rekam jejak sumber terbuka BFL benar-benar baik, tetapi rencana tetaplah rencana.
Satu untuk tampilan, satu untuk keyframe, satu untuk sambungan. Salin, tukar tanda kurung, render — dalam mode draf terlebih dahulu.
"Sebuah adegan stop-motion buatan tangan: [astronaut] dari tanah liat menancapkan bendera kertas kecil di bulan meja dapur yang terbuat dari tepung. Sidik jari terlihat pada tanah liat, gerakan 12fps yang sedikit tersendat, cahaya jendela yang lembut, suara langkah kaki felt, dan satu baris dialog teredam dengan suara melengking."
Menyebutkan ketidaksempurnaan — sidik jari, frame rate tersendat — adalah yang menjauhkan FLUX 3 dari kilap default. Sebagian besar model melawan “buatan tangan”; yang satu ini memperlakukannya sebagai target gaya.
Unggah: 4 keyframe (produk dalam kotak → dibuka dari kotak → di tangan → kartu logo)
"Video unboxing 20 detik yang menampilkan empat frame ini secara berurutan, dengan jarak sekitar 5 detik. Nuansa handheld yang alami, suara kertas disobek dan selotip, kegembiraan pelan dari suara di luar layar pada frame ketiga."
Frame membawa komposisi, jadi prompt hanya perlu mengarahkan timing, gerakan, dan suara. Petunjuk jarak ("kira-kira berjarak 5 detik") mencegah model terburu-buru melewati beat. Inilah alur kerja yang telah dinantikan oleh tim yang mengutamakan storyboard.
Mulai dari: klip yang sudah Anda hasilkan
"Perpanjang 10 detik: [dancer] menyelesaikan putaran tempat klip berakhir, kamera terus bergeser ke kiri dengan kecepatan yang sama, musik berlanjut tanpa hambatan — tanpa potongan, tanpa reset."
Ekstensi membaca gerakan dan audio pada frame akhir, jadi instruksi harus menggambarkan kelanjutan, bukan adegan baru. "Menyelesaikan putaran tempat klip berakhir" memberinya benang fisik untuk ditarik; menyebutkan kecepatan kamera melindungi pergeseran melintasi sambungan.
Tiga model audio-native, tiga filosofi kontrol. Prompt yang sama di ketiganya, dinilai berdasarkan apa yang akan kami rilis — sementara untuk dua yang lebih baru. Bandingkan sendiri dari satu kotak prompt.
diumumkan 23 Juli: satu arsitektur untuk gambar, video, audio, dan aksi. Video dirilis terlebih dahulu (20 s, audio native, keyframe); pembuatan gambar akan diluncurkan dalam beberapa minggu berikutnya; rilis Dev berbobot terbuka direncanakan untuk akhir tahun ini. Versi di halaman ini.
era gambar yang membuat nama itu dikenal: FLUX.1 dev menjadi salah satu rilis difusi terbuka yang paling banyak diunduh dan disesuaikan di mana pun, tulang punggung dari tak terhitung alur kerja komunitas.
tim pendiri membangun arsitektur difusi laten di balik Stable Diffusion. Kredibilitas sumber terbuka yang diperoleh dari sejarah itu adalah alasan mengapa "FLUX 3 Dev" memiliki bobot lebih sebagai janji daripada sebagian besar komitmen bobot terbuka.
Model fondasi multimodal pertama Black Forest Labs, diumumkan pada 23 Juli 2026 — satu arsitektur yang dilatih bersama pada gambar, video, audio, dan prediksi tindakan, dari tim Freiburg yang para pendirinya membangun arsitektur di balik Stable Diffusion. Bagian yang bisa Anda gunakan untuk menghasilkan hari ini adalah video: hingga 20 detik dengan soundtrack yang tersinkronisasi dalam proses yang sama, dari teks, gambar awal, keyframe yang dipasangkan, atau klip yang sudah ada yang ingin Anda perpanjang.
Sang realis. Saat klip harus tampak seperti rekaman nyata, dengan audio.
Pengambilan gambar panjang. Shot 30 detik yang dipotong mengikuti soundtrack Anda.
Pembaca dokumen. Dek, PDF, dan spreadsheet masuk, video keluar.