MiniMax, syarikat permulaan kecerdasan buatan yang berpangkalan di Beijing, melancarkan model penjanaan video terbaharunya, H3, pada 31 Julai 2026, mempergiatkan persaingan yang sudah sengit untuk menguasai video yang dijana oleh AI. Keluaran ini meletakkan MiniMax secara langsung berbanding ByteDance, yang melancarkan model Seedance 2.5 yang dikemas kini sendiri pada minggu yang sama dalam apa yang digambarkan oleh Bloomberg sebagai pertarungan "pertarungan" antara dua syarikat AI yang paling bercita-cita tinggi di China. Untuk liputan berterusan perkembangan AI terkini, ikuti laporan langsung kami.

Perkara yang dibawa oleh H3 ke meja

Menurut Reuters, model H3 MiniMax boleh menjana klip video pada resolusi 2K — peningkatan ketara daripada output 1080p yang telah menjadi standard de facto untuk kebanyakan alat AI video yang dihadapi pengguna. Model ini juga menghasilkan bunyi stereo yang disegerakkan dengan rakaman yang dijana, keupayaan yang kekal jarang berlaku dalam ruang penjanaan video, di mana kebanyakan model mengeluarkan klip senyap yang memerlukan saluran paip audio yang berasingan.

Mungkin keputusan yang paling strategik penting ialah komitmen MiniMax untuk wajaran terbuka. South China Morning Post melaporkan bahawa MiniMax mengeluarkan H3 dengan berat model sumber terbuka dan pada titik harga yang sengaja mengurangkan pesaing — gabungan penerbitan yang dirangka sebagai cabaran langsung kepada pendekatan komersil tertutup ByteDance. Wajaran terbuka membolehkan pembangun dan penyelidik memuat turun, memeriksa, memperhalusi dan menggunakan model pada infrastruktur mereka sendiri dan bukannya bergantung semata-mata pada API yang dihoskan.

MiniMax menyifatkan H3 sebagai model "semua-modal", menurut AIBase, mencadangkan ia direka bentuk untuk mengendalikan berbilang jenis input dan output — teks, imej, audio dan video — dalam satu seni bina dan bukannya memerlukan model khusus berasingan yang dirantai bersama.

Reaksi pasaran

Pelabur bertindak balas dengan pantas. Finance.biggo.com melaporkan bahawa saham MiniMax meningkat hampir 13% berikutan pengumuman H3, mencerminkan keyakinan pasaran bahawa harga agresif syarikat dan strategi wajaran terbuka boleh menangkap perkongsian minda pembangun dalam kategori di mana ekosistem Doubao ByteDance telah mendahului.

Perang harga adalah nyata. SCMP menyatakan bahawa MiniMax menawarkan video yang dijana H3 pada kos yang jauh di bawah kadar lazim, dengan pertaruhan bahawa harga setiap generasi yang lebih rendah akan menarik pengguna volum tinggi — daripada pencipta media sosial kepada agensi pemasaran kepada pembuat filem bebas — yang sangat sensitif terhadap kos setiap klip.

ByteDance melancarkan semula dengan Seedance 2.5

ByteDance tidak membiarkan detik itu berlalu tanpa jawapan. Pada garis masa yang sama, ia mengeluarkan Seedance 2.5, lelaran terkini model penjanaan videonya. Menurut Pandaily dan CineD, Seedance 2.5 boleh menghasilkan video 30 saat dalam satu generasi — peningkatan bermakna berbanding model terdahulu yang biasanya memerlukan jahitan bersama klip yang lebih pendek untuk mencapai urutan yang lebih panjang.

CineD melaporkan bahawa Seedance 2.5 menerima sehingga 50 input rujukan, membolehkan pengguna membimbing penjanaan dengan berbilang imej, gesaan teks dan rujukan visual secara serentak. Model ini juga memperkenalkan sekatan kamera 3D, memberikan pencipta kawalan peringkat pengarah ke atas pergerakan kamera maya — kuali, boneka dan laluan orbit — dalam adegan yang dijana. TechNode dan Tech in Asia mengesahkan keupayaan berbilang input dan penyuntingan model, meletakkannya sebagai alat untuk penghasilan video yang didorong oleh naratif yang lebih canggih.

CNET sebelum ini telah melaporkan bahawa Seedance 2.5 dijangka dilancarkan "sebaik sahaja minggu ini," dan keluaran serentak dengan H3 MiniMax menggariskan betapa mampatnya kitaran persaingan telah menjadi dalam video AI Cina.

Mengapa perlumbaan AI video penting

Persaingan MiniMax-versus-ByteDance adalah lebih daripada pertempuran serantau. Penjanaan video AI telah menjadi salah satu sempadan yang paling berintensif modal dan menuntut secara teknikal dalam kecerdasan buatan, memerlukan sumber pengiraan yang besar untuk latihan dan inferens. Pesaing global — termasuk Sora OpenAI, Veo Google, dan bidang pemula yang semakin berkembang — semuanya berlumba-lumba untuk menghasilkan video yang lebih panjang, resolusi lebih tinggi, lebih terkawal daripada gesaan teks dan imej.

Ekosistem video AI China telah bergerak dengan kelajuan tertentu. Keputusan MiniMax untuk sumber terbuka pemberat H3 mengikut corak yang lebih luas di kalangan makmal AI China — termasuk DeepSeek, pembuat Qwen Alibaba, dan lain-lain — mengeluarkan model pemberat terbuka yang berkuasa untuk membina ekosistem pembangun dan mewujudkan kredibiliti teknikal, walaupun dengan kos eksklusiviti komersial jangka pendek.

Kemasukan audio stereo dalam H3 amat ketara. Kebanyakan model penjanaan video hari ini menghasilkan output visual sahaja, meninggalkan audio sebagai langkah yang berasingan, selalunya manual. Jika MiniMax telah benar-benar menyelesaikan penjanaan audio yang disegerakkan pada resolusi 2K, ia akan mewakili pencapaian penyepaduan yang bermakna — walaupun penanda aras bebas dan penilaian langsung diperlukan untuk menilai kualiti dan kebolehpercayaan sebenar output.

Soalan terbuka

Pelepasan berat terbuka MiniMax juga mencetuskan semula perdebatan yang telah memecah belahkan industri AI. Penyokong berpendapat bahawa pemberat terbuka mempercepatkan penyelidikan, membolehkan penelitian keselamatan, dan halangan yang lebih rendah untuk pembangun yang lebih kecil. Pengkritik - termasuk beberapa makmal sempadan Barat - berpendapat bahawa mengeluarkan model generatif yang berkuasa secara terbuka meningkatkan risiko penyalahgunaan, daripada palsu kepada maklumat yang salah.

Buat masa ini, MiniMax bertaruh bahawa muhibah pembangun dan penguncian ekosistem daripada wajaran terbuka akan mengatasi sebarang kelemahan kompetitif. Sama ada pertaruhan itu membuahkan hasil bergantung pada penerimaan: jika H3 menjadi alat lalai untuk pencipta video di seluruh China dan seterusnya, strategi berwajaran terbuka boleh membuktikan sebagai berbangkit untuk AI video kerana keluaran Meta Llama adalah untuk teks.

Persaingan segera, bagaimanapun, adalah jelas. Dua daripada syarikat AI terbesar di China telah melancarkan tangkapan terbaru mereka dalam peperangan penjanaan video pada hari yang sama — dan kadarnya semakin pantas.

---

Kekal Mendahului AI

Dapatkan berita, analisis dan penemuan terkini AI — semuanya di satu tempat.

**Baca lebih banyak berita AI →