Model Video dan Gambar AI Flux 3

Model Video dan Gambar AI Flux 3

Flux 3 adalah model multimodal Black Forest Labs untuk video, gambar, audio native, dan prediksi tindakan. Jelajahi fitur Flux 3 yang telah dikonfirmasi dan rencana akses awal.

  • Video Native dengan Audio Tersinkron: Flux 3 dapat menghasilkan beragam video dengan audio native dalam sekali proses, dengan klip hingga 20 detik selama akses awal. Black Forest Labs menyoroti sinkronisasi ucapan, efek suara, dan peristiwa fisik, tetapi evaluasi yang dipublikasikan masih bersifat awal.
  • Input dan Referensi Multimodal: Flux 3 mendukung teks-ke-video, gambar-ke-video, video-ke-video, dan kelanjutan video-audio. Gambar dapat menjadi bingkai awal atau referensi visual, sedangkan klip sumber dapat membawa karakter atau elemen utama ke adegan baru.
  • Keyframe, Urutan Panjang, dan Tipografi: Flux 3 mencakup transisi keyframe-ke-video, dialog multibahasa, tipografi animasi, beragam rasio aspek, dan perangkaian klip secara agentik. Black Forest Labs menyatakan referensi visual dapat mempertahankan karakter antarpengambilan, tetapi pengujian independen masih terbatas.
  • Satu Fondasi Melampaui Video: Flux 3 juga menargetkan sintesis dan penyuntingan gambar serta prediksi tindakan dari fondasi multimodal yang sama. Akses awal gambar direncanakan setelah pratinjau video, sedangkan tindakan dimulai dengan mitra riset dan komersial terpilih seperti mimic robotics.
  • Model Multimodal Bobot Terbuka yang Direncanakan: Flux 3 Dev direncanakan sebagai fondasi bobot terbuka untuk video, audio, gambar, dan prediksi tindakan. Black Forest Labs belum mengumumkan tanggal rilis, lisensi, ukuran model, kebutuhan perangkat keras, harga API, atau tolok ukur produksi final.
  • Tentukan adegan dan referensi: Mulailah dari subjek, lingkungan, aksi, gerakan kamera, durasi, rasio aspek, dialog, dan suara. Saat akses Flux 3 mendukung referensi, tambahkan gambar awal, keyframe, atau klip sumber lalu tentukan detail yang harus tetap konsisten.
Model Multimodal Black Forest Labs

Model Video dan Gambar AI Flux 3

Flux 3 adalah model multimodal Black Forest Labs untuk video, gambar, audio native, dan prediksi tindakan. Jelajahi fitur Flux 3 yang telah dikonfirmasi dan rencana akses awal.

Jelajahi Video AI

Showcase video resmi Flux 3

Tonton empat sampel peluncuran yang diterbitkan Black Forest Labs pada 23 Juli 2026. Klip resmi Flux 3 ini menampilkan cuaca pesisir, balapan sudut pandang orang pertama, adegan tari di antara cermin, dan animasi tanah liat bernuansa hangat.

Dinamika laut Flux 3

Sampel peluncuran resmi Flux 3 yang menampilkan ombak badai, percikan air, dan burung laut di sepanjang pesisir.

Gerakan orang pertama Flux 3

Sampel peluncuran resmi Flux 3 yang mengikuti sepeda motor di sirkuit basah dengan gerakan kamera cepat, aspal basah, dan pembatas lintasan.

Cermin, air, dan tarian

Sampel peluncuran resmi Flux 3 yang menampilkan tarian ballroom di antara arsitektur cermin, air, cahaya lilin, dan pantulan berlapis.

Animasi karakter bergaya Flux 3

Sampel resmi Flux 3 dengan animasi tanah liat hangat, material taktil, dan gerakan fisik yang berpusat pada karakter.

Keunikan Flux 3

01 / Video • Audio

Video Native dengan Audio Tersinkron

Flux 3 dapat menghasilkan beragam video dengan audio native dalam sekali proses, dengan klip hingga 20 detik selama akses awal. Black Forest Labs menyoroti sinkronisasi ucapan, efek suara, dan peristiwa fisik, tetapi evaluasi yang dipublikasikan masih bersifat awal.

02 / Teks • Gambar • Video

Input dan Referensi Multimodal

Flux 3 mendukung teks-ke-video, gambar-ke-video, video-ke-video, dan kelanjutan video-audio. Gambar dapat menjadi bingkai awal atau referensi visual, sedangkan klip sumber dapat membawa karakter atau elemen utama ke adegan baru.

03 / Kontrol • Kontinuitas

Keyframe, Urutan Panjang, dan Tipografi

Flux 3 mencakup transisi keyframe-ke-video, dialog multibahasa, tipografi animasi, beragam rasio aspek, dan perangkaian klip secara agentik. Black Forest Labs menyatakan referensi visual dapat mempertahankan karakter antarpengambilan, tetapi pengujian independen masih terbatas.

04 / Gambar • Tindakan

Satu Fondasi Melampaui Video

Flux 3 juga menargetkan sintesis dan penyuntingan gambar serta prediksi tindakan dari fondasi multimodal yang sama. Akses awal gambar direncanakan setelah pratinjau video, sedangkan tindakan dimulai dengan mitra riset dan komersial terpilih seperti mimic robotics.

05 / Dev • Bobot Terbuka

Model Multimodal Bobot Terbuka yang Direncanakan

Flux 3 Dev direncanakan sebagai fondasi bobot terbuka untuk video, audio, gambar, dan prediksi tindakan. Black Forest Labs belum mengumumkan tanggal rilis, lisensi, ukuran model, kebutuhan perangkat keras, harga API, atau tolok ukur produksi final.

Peran Flux 3 dalam alur produksi video

Alur kerja ini didasarkan pada kemampuan yang diumumkan Black Forest Labs dan ditujukan bagi pengguna akses awal yang telah disetujui. Fitur, antarmuka, dan ketentuan penggunaan dapat berubah sebelum tersedia secara umum.

Tentukan adegan dan referensi

Mulailah dari subjek, lingkungan, aksi, gerakan kamera, durasi, rasio aspek, dialog, dan suara. Saat akses Flux 3 mendukung referensi, tambahkan gambar awal, keyframe, atau klip sumber lalu tentukan detail yang harus tetap konsisten.

Buat dan evaluasi shot utama

Gunakan Flux 3 untuk membuat shot utama, lalu periksa anatomi, persistensi objek, sinkronisasi bibir, waktu audio, gerakan fisik, tipografi, dan kontinuitas kamera. Ubah satu variabel pada satu waktu daripada menulis ulang seluruh prompt setelah setiap pratinjau.

Perpanjang, rangkai, dan selesaikan

Menurut Black Forest Labs, referensi visual dan keyframe dapat membantu merangkai klip menjadi urutan multi-shot yang lebih panjang. Penggunaan untuk produksi dan pembagian kepada publik tetap tunduk pada ketentuan serta izin akses Flux 3 yang berlaku.

Pertanyaan Umum tentang Flux 3

Jelajahi Video AI Sambil Menunggu Flux 3 Diluncurkan

Jelajahi Video AI