Black Forest Labs wis ngrilis FLUX 3, model yayasan multimodal sing dikandhakake perusahaan sinau bareng saka gambar, video, lan audio kanggo mbangun perwakilan siji saka jagad fisik. Diumumake tanggal 23 Juli 2026, lan saiki kasedhiya ing akses awal, FLUX 3 nggambarake pamindhahan arsitektur sing signifikan saka pendekatan model-by-modalitas sing wis ndominasi AI generatif, nggawe gambar ambruk, generasi video kanthi swara asli, lan malah kontrol robot dadi siji sistem terpadu.
Peluncuran teka ing wayahe kompetisi intensif ing ruang media generatif, ing ngendi para pemain kalebu Runway, OpenAI's Sora, lan Google Veo wis balapan kanggo ngasilake model video sing luwih dhuwur lan luwih apik. FLUX 3 mlebu kontes iki kanthi dhasar sing beda: model sing kapisah kanggo saben jinis media minangka watesan buatan. Kemajuan kasebut dipantau minangka bagean saka [liputan industri AI] (https://aibuzzwire.news) lanskap media generatif.
Model Unified Reality
Ing kiriman blog sing ngiringi rilis kasebut, Black Forest Labs nyedhiyakake motivasi teoritis kanggo nglatih model siji ing macem-macem modalitas. Perusahaan kasebut ujar manawa ora ana modalitas siji - manawa gambar, video, utawa audio - menehi katrangan lengkap babagan kasunyatan. Saben minangka proyeksi jagad fisik sing padha, dijupuk dening sensor sing beda-beda, saben-saben ilang informasi sajrone proses kasebut.
Gambar njupuk struktur spasial ing wektu tartamtu. Video mulihake dimensi wektu lan mbukak dinamika temporal lan hukum fisik. Audio nuduhake hubungan sebab akibat antarane fenomena mekanik lan akustik sing ora bisa dideteksi dening sesanti. Basa ngubungake persepsi kasebut menyang tujuan, abstraksi, lan instruksi, perusahaan kasebut nulis.
Kanthi sinau saka kabeh iki bebarengan, kendala bebarengan model menehi informasi luwih akeh tinimbang modalitas siji wae. Swara kudu cocog karo impact, gerakan kudu manut massa, mangsa kudu tindakake saka kepungkur. Modalitas mandheg dadi kapisah lan wiwit dadi bukti babagan siji kasunyatan sing ndasari.
FLUX 3 minangka model pisanan perusahaan sing dibangun kanthi prinsip iki, sing diarani Black Forest Labs Self-Flow - pendekatan kanggo nyelarasake generasi lan pemahaman multimodal kanthi efisien ing arsitektur dhasar sing padha.
Generasi Video Kanthi Audio Asli
Kapabilitas FLUX 3 sing paling nyenengake yaiku kemampuan kanggo ngasilake video nganti 20 detik kanthi audio asli sing disinkronake ing pass generasi siji. Iki mbedakake saka umume model video sing wis ana, sing ngasilake rekaman bisu sing kudu dipasangake karo audio sing digawe kanthi kapisah.
Miturut perusahaan kasebut, output video FLUX 3 utamane kuwat kanggo njupuk ekspresi rai manungsa, nggandhengake swara karo acara fisik, lan ndhukung kemampuan multibasa. Kapabilitas iki bisa digabungake kanggo nggawe urutan sing tahan sawetara menit, ing ngendi referensi visual mbantu mesthekake yen karakter tetep konsisten ing kabeh adegan.
Ing evaluasi manungsa awal sing ditindakake sajrone latihan, FLUX 3 luwih disenengi tinimbang Runway Gen-4.5 ing 77% perbandingan lan Luma Ray 3.2 ing 93% mbandhingake. Nglawan pesaing sing luwih anyar, luwih disenengi tinimbang Grok Imagine Video nganti 69% mbandhingake, Kling v3 Pro ing 60%, lan Seedance 2.0 lan Gemini Omni Flash ing 52%.
Perusahaan kasebut ngelingake manawa asil kasebut minangka pendahuluan lan perbaikan luwih lanjut ditindakake sajrone fase akses awal.
Gambar lan Teks Rendering
Ngluwihi video, FLUX 3 bisa nyintesis lan nyunting gambar ing macem-macem gaya, rasio aspek, lan resolusi. Black Forest Labs nglapurake dandan sing signifikan ing versi FLUX sadurungé ing nangani pituduh rumit lan ngasilake teks sing akurat ing gambar - tantangan sing terus-terusan kanggo model gambar generatif.
Fase akses awal kanggo kapabilitas Gambar FLUX 3 bakal mbukak ing minggu sawise rilis video, ujare perusahaan kasebut.
Jembatan menyang AI Fisik
Mbok menawa aspek sing paling ora konvensional saka FLUX 3 yaiku ekstensi menyang robotika. Pemahaman donya model kasebut ngluwihi prediksi aksi, perusahaan nerangake, njupuk rong rute menyang AI fisik: nggabungake prediksi aksi native langsung menyang FLUX 3, lan nggunakake backbone video sing wis dilatih minangka dhasar kanggo model aksi khusus sing disetel kanthi data khusus tugas sing winates.
Black Forest Labs kerja sama karo robot mimic, sing dadi salah sawijining perusahaan pertama sing entuk akses awal menyang FLUX 3. Bebarengan padha ngembangake FLUX-mimic, model aksi video sing nggabungake tulang punggung FLUX 3 kanthi keahlian mimic ing sinau robot kanggo manipulasi dexterous. Miturut perusahaan, sistem kasebut wis diuji ing tugas produksi nyata ing Audi.
Iki nggambarake konvergensi sing penting: teknologi dhasar sing padha digunakake kanggo ngasilake konten hiburan ditrapake kanggo ngontrol robot fisik ing lingkungan manufaktur. Tesis perusahaan yaiku AI fisik lan nggawe konten mlaku ing dhasar sing padha, amarga loro-lorone mbutuhake model sing ngerti kepiye obyek terus bebarengan, kepiye gerakane, lan kepiye kedadeyan fisik ngasilake swara.
Kompetisi lan Posisi Pasar
Peluncuran posisi Black Forest Labs - wiwitan berbasis Berlin ing mburi model generasi gambar FLUX sing akeh digunakake - minangka pesaing sing luwih ambisius ing ruang AI generatif. Nalika perusahaan kaya Runway wis fokus sempit ing video lan OpenAI ing teks lan chatbots multimodal, Black Forest Labs taruhan sing model saestu manunggal antarane visual, auditory, lan domain fisik bakal mbuktekaken luwih saged saka alternatif khusus.
Perusahaan kasebut ujar manawa wis nggarap model generasi sabanjure, kanthi tujuan nggabungake prediksi persepsi, tumindak, lan basa ing model sing padha. Sajrone minggu lan sasi sing bakal teka, bakal ngluncurake kapabilitas tambahan sing dibangun saka arsitektur pencocokan aliran multimodal sing padha, saben sawise fase akses awal kanggo umpan balik lan tes safety.
FLUX 3 saiki kasedhiya ing akses awal kanggo nggawe video, kanthi gambar lan kemampuan tambahan sing diluncurake kanthi bertahap.
Tetep Ahead of AI
Pendekatan terpadu FLUX 3 kanggo gambar, video, audio, lan robotik nandhani owah-owahan penting babagan carane model AI generatif dirancang. Kanggo luwih akeh babagan balapan media generatif lan perkembangan paling anyar ing intelijen buatan, tututi liputan [kabar AI] (https://aibuzzwire.news).
Waca liyane warta AI →
