Penjana Video AI FLUX 3

Model video pertama Black Forest Labs: klip 20 saat dengan audio disegerakkan, sehingga 10 bingkai utama dipinkan, dan gaya visual daripada aksi langsung hingga gerak henti. Taip gesaan di bawah dan cubalah.

Model
Muat Naik Imej
Klik atau lepaskan imej di sini JPG, JPEG, PNG atau WEBP sehingga 10 MB
Gesaan
0/5000
Nisbah Aspek Output
Auto
Resolusi
Auto
Tempoh(saat)
Auto
Sampel Video
 

Pembangun

Black Forest Labs

Jenis

Multimodal (video sekarang, imej tidak lama lagi)

Audio

Asli, disegerakkan, kata laluan yang sama

Tempoh

Sehingga 20 s setiap laluan

Bingkai kunci

Sehingga 10 disemat + pertama/terakhir

Buka pemberat

Pembangunan dirancang, lewat 2026

Peringkat di sini

Kredit berbayar + mod draf

Keputusan kami dalam satu baris: pilihan papan cerita. Apabila anda tahu dengan tepat bingkai mana yang mesti dicapai oleh syot — atau anda mahukan rupa yang bukan “video AI sinematik” — mulakan di sini.

FLUX 3 datang daripada makmal Freiburg yang pengasasnya membina seni bina di sebalik Stable Diffusion, dan ini model pertama mereka yang bergerak: satu rangkaian yang dilatih bersama pada imej, video, audio dan aksi, dengan video dihantar dahulu. Dua perkara membezakannya dalam bulan yang sesak — anda boleh menetapkan sehingga sepuluh bingkai tepat dan membiarkan model menganimasikan antara bingkai tersebut, dan output tidak terkunci pada rupa “sinematik AI” yang berkilat. Mentah, nostalgia, buatan tangan, pelik: julat itulah intinya.

Pandangan jujur

Di mana FLUX 3 menang — dan di mana ia tidak

Tanggapan awal daripada render ujian kami serta bahan yang diterbitkan oleh BFL — dengan peringatan mereka sendiri disampaikan tanpa diubah. Kami akan menyemak semula apabila angka bebas tersedia.

Benar-benar kuat

  • • Kawalan bingkai utama.

    Sematkan sehingga 10 bingkai tepat serta bingkai pertama dan terakhir, dan model menjana gerakan, kamera, dialog dan audio di antaranya. Papan cerita sebagai format input — tiada apa-apa lagi yang kami hos yang menerima penambat sebanyak ini.

  • • Julat estetik.

    Stop-motion, makro, time-lapse, video rumah yang nostalgik, sengaja pelik — ia terlepas daripada kilauan sinematik seragam yang digunakan secara lalai oleh kebanyakan model video. Jika rupa jenama anda bukan "treler filem", ini penting.

  • • Audio dalam laluan yang sama.

    Sehingga 20 saat dengan runut bunyi yang disegerakkan — dialog disertakan — dan pelanjutan peka sambungan yang membawa pergerakan, kamera dan audio merentasi titik sambungan apabila anda memanjangkan klip.

  • • Ekonomi mod draf.

    Setiap titik akhir mempunyai varian draf yang pantas untuk pratonton murah. Ulang kaji pada draf, belanjakan kredit sebenar sekali sahaja pada versi akhir — aliran kerja yang disarankan oleh seluruh laman ini, terbina dalam keluarga model.

Had yang diketahui

  • • Bahagian imej belum ada di sini lagi.

    Nama FLUX terkenal dengan imej, tetapi penjanaan imej FLUX 3 masih dilancarkan secara berperingkat. Jika anda datang ke sini untuk membuat gambar, ia masih mengambil masa beberapa minggu — lihat FAQ sebelum anda membakar kredit untuk mengetahuinya.

  • • Penanda aras ialah nombor rumah.

    Carta pelancaran dilabelkan sebagai penilaian awal bagi calon peringkat awal, dan kadar kemenangan yang paling menyerlah diperoleh terhadap model yang tidak menetapkan rentak semasa. Dakwaan BFL yang kemudian adalah lebih kukuh tetapi masih bersifat dalaman.

  • • 20 saat, bukan 30.

    Wan 3.0 dan Seedance 2.5 kedua-duanya mencapai 30 dalam satu laluan. FLUX 3 menjawab dengan sambungan yang menghormati cantuman — tetapi jika taklimatnya ialah setengah minit tunggal tanpa putus, itu bukan pilihan yang tepat.

  • • Pemberat pembangunan: dirancang, belum bertarikh.

    Keluaran dengan pemberat terbuka diumumkan untuk kemudian pada 2026, tanpa tarikh atau terma lesen. Rekod sumber terbuka BFL memang baik, tetapi rancangan tetap rancangan.

Resipi prompt

Tiga prompt yang tunjukkan kegunaannya

Satu untuk rupa, satu untuk kerangka kunci, satu untuk sambungan. Salin, tukar kurungan, render — dalam mod draf dahulu.

Anti-sinematik — julat gaya yang dipaparkan

"Satu adegan gerak henti buatan tangan: seorang [astronaut] tanah liat mencacakkan bendera kertas kecil di atas bulan meja dapur yang diperbuat daripada tepung. Cap jari kelihatan pada tanah liat, gerakan 12fps yang sedikit tersentak-sentak, cahaya tingkap yang lembut, bunyi langkah kaki felt dan sebaris dialog teredam dengan suara mencicit."

Mengapa ia berfungsi

Menamakan ketidaksempurnaan — cap jari, kadar bingkai tersentak-sentak — ialah yang mengalihkan FLUX 3 daripada kilauan lalai. Kebanyakan model melawan “buatan tangan”; yang ini memperlakukannya sebagai sasaran gaya.

Kunci papan cerita — bingkai utama sebagai skrip

Muat naik: 4 bingkai utama (produk berkotak → dibuka kotak → di tangan → kad logo)

"Video unboxing 20 saat yang memaparkan empat bingkai ini mengikut urutan, kira-kira selang 5 saat. Rasa rakaman pegang tangan yang semula jadi, bunyi kertas dikoyak dan pita pelekat, kegembiraan perlahan daripada suara di luar skrin pada bingkai ketiga."

Mengapa ia berfungsi

Bingkai membawa komposisi, jadi prompt hanya perlu mengarahkan masa, gerakan dan bunyi. Petunjuk jarak ("kira-kira 5 saat antara satu sama lain") menghalang model daripada tergesa-gesa melalui rentak. Inilah aliran kerja yang ditunggu-tunggu oleh pasukan yang mengutamakan storyboard.

Sambungan yang lancar

Mula dari: klip yang telah anda jana

"Lanjutkan selama 10 saat: [dancer] melengkapkan pusingan yang menjadi penghujung klip, kamera terus hanyut ke kiri pada kelajuan yang sama, muzik berterusan tanpa sebarang gangguan — tiada potongan, tiada tetapan semula."

Mengapa ia berfungsi

Sambungan membaca gerakan dan audio bingkai akhir, jadi arahan harus menerangkan kesinambungan, bukan adegan baharu. "Melengkapkan pusingan tempat klip berakhir" memberinya benang fizikal untuk ditarik; menyatakan kelajuan kamera melindungi drift merentasi sambungan.

Bersemuka

FLUX 3 vs Veo vs Seedance 2.5

Tiga model audio-native, tiga falsafah kawalan. Prompt yang sama merentas ketiga-tiganya, dinilai berdasarkan apa yang akan kami keluarkan — secara sementara untuk dua yang lebih baharu. Bandingkannya sendiri daripada satu kotak gesaan.

JobFLUX 3VeoSeedance 2.5
Bingkai utama / kawalan struktur 10 disemat + pertama/terakhir Prompt sahaja Bingkai pertama/terakhir
Gaya bukan sinematik Terbaik — daripada gerak henti hingga yang pelik Sederhana Baik
Rakaman realistik Baik (awal) Terbaik Baik (awal)
Panjang klip maks 20 s + lanjutkan peka jahitan 8 s 30 s asli
Rentak dipacu audio daripada trek Tidak Tidak Ya
Iterasi murah Varian draf terbina dalam Tiada peringkat draf Draf melalui item searas pantas
Peta jalan pemberat terbuka Pembangunan dirancang, rekod kukuh Tiada Tiada
Rekod prestasi terbukti Usia dalam minggu Ditubuhkan Minggu
Sejarah versi

Daripada makmal imej kepada multimodal

Jul 2026 · Semasa

FLUX 3

diumumkan pada 23 Julai: satu seni bina untuk imej, video, audio dan tindakan. Video dikeluarkan terlebih dahulu (20 s, audio asli, keyframe); penjanaan imej akan dilancarkan dalam minggu-minggu berikutnya; keluaran Dev berwajaran terbuka dirancang untuk lewat tahun ini. Versi pada halaman ini.

Terdahulu

FLUX.2 dan keluarga FLUX.1

era imej yang membuat nama itu terkenal: FLUX.1 dev menjadi salah satu keluaran difusi terbuka yang paling banyak dimuat turun dan diperhalusi di mana-mana, tulang belakang kepada banyak aliran kerja komuniti.

Asal

Sebelum FLUX

pasukan pengasas membina seni bina difusi laten di sebalik Stable Diffusion. Kredibiliti sumber terbuka yang diberikan oleh sejarah itu ialah sebab "FLUX 3 Dev" mempunyai lebih banyak nilai sebagai janji berbanding kebanyakan ikrar pemberat terbuka.

Soalan Lazim

FLUX 3 soalan, dijawab terus terang

1. Apakah itu FLUX 3?

Model asas multimodal pertama Black Forest Labs, diumumkan pada 23 Julai 2026 — satu seni bina yang dilatih bersama pada imej, video, audio dan ramalan tindakan, daripada pasukan Freiburg yang pengasasnya membina seni bina di sebalik Stable Diffusion. Bahagian yang boleh anda jana hari ini ialah video: sehingga 20 saat dengan runut bunyi yang disegerakkan dalam laluan yang sama, daripada teks, imej permulaan, kerangka utama yang dipinkan, atau klip sedia ada yang ingin anda panjangkan.

Model lain

Bukan alat yang betul? Cuba yang berdekatan

Veo

Si realis. Apabila klip perlu kelihatan seperti rakaman sebenar, dengan audio.

Seedance 2.5

Ambilan panjang. Syot 30 saat dipotong mengikut runut bunyi anda.

Wan 3.0

Pembaca dokumen. Dek, PDF dan hamparan masuk, video keluar.