Makmal AI Cina MiniMax telah mengambil pendekatan luar biasa untuk keluaran terbarunya: ia hampir tidak mengakuinya. Pada 27 September, akaun rasmi syarikat mengesahkan perkara yang telah dilihat oleh pembangun dalam produk itu — model baharu yang dipanggil M3.1-Flash-Preview telah disiarkan secara langsung di dalam MiniMax Code, pembantu pengekodan syarikat. Itulah tahap pelancaran: tiada kad model, tiada jadual penanda aras, tiada harga bagi setiap juta token.

Pemerhati AI Cina pada X telah melihat model itu muncul dalam produk sebelum pengesahan, menurut Startup Fortune. Pelancaran yang disenyapkan adalah kontras yang ketara dengan cara MiniMax menghantar perdana terakhirnya. For more context on this story, see our ongoing AI industry coverage.

Debut Sengaja Senyap

Apabila MiniMax melancarkan M3 pada bulan Jun, syarikat itu menerbitkan butiran seni bina, skor bangku SWE dan lembaran harga yang mengurangkan pesaing sebanyak 90%. Kali ini, titik akhir API untuk M3.1-Flash-Preview adalah berpagar, dan satu-satunya cara untuk mencuba model adalah di dalam produk MiniMax sendiri, dengan jejak penaakulan dan tingkah laku sebagai isyarat utama yang boleh diperhatikan.

Strategi rendah mencadangkan MiniMax mungkin menganggap keluaran kurang seperti pelancaran tajuk dan lebih seperti percubaan: A/B menguji ciri produk dan membiarkan internet mengetahuinya. Itu boleh mencerminkan keyakinan bahawa model itu akan bercakap dengan sendirinya sebaik sahaja pembangun menggunakannya — atau ringkasnya bahawa keluaran ini bukanlah yang besar, tetapi peringkat pendamping yang lebih pantas dan lebih murah.

Perkara yang Diberitahukan oleh Base M3 kepada Kami

Model M3 asas menawarkan gambaran tentang apa yang boleh dihantar oleh MiniMax apabila ia mahukan perhatian. Ia ialah model campuran pakar 428 bilion parameter dengan kira-kira 23 bilion parameter aktif setiap token, tetingkap konteks satu juta token dan input imej dan video asli. Pada SWE-bench Verified, MiniMax melaporkan skor 80.5%.

Flash ialah versi barisan yang dibina untuk menajamkan kelajuan dan kelebihan harga untuk pengekodan setiap hari — pembetulan pepijat pantas dan pembangun kerja ciri kecil dijalankan berpuluh-puluh kali sehari, dan bukannya tugas agenik jangka panjang yang dikhaskan untuk perdana. Memisahkan barisan model dengan cara ini, dengan versi sempadan yang besar dan rakan yang pantas dan murah, telah menjadi buku main standard di kalangan makmal Cina yang bersaing untuk perkongsian minda pembangun.

Penghantaran Ke Padang Sesak

MiniMax tidak melepaskan ke pasaran yang tenang. Alibaba mengeluarkan Qwen3.8-Max pada 3 Ogos — perdana 2.4 trilion parameter berharga $2 setiap juta token input — kemudian diikuti pada 12 Ogos dengan versi berat terbuka pertama bagi model Qwen peringkat Max. GLM-5.3 Zhipu mendarat pada 14 Ogos dengan tetingkap konteks jutaan token sendiri.

Pemaju telah melihat banjir pilihan yang mampu dan murah. Menurut laporan CNBC tentang data OpenRouter, model Cina menyumbang 57% hingga 67% daripada jumlah penggunaan token pada platform untuk minggu yang termasuk 14 September — meningkat daripada hanya 6% kepada 13% pada bulan Februari. Vercel menyaksikan lonjakan yang sama, dengan bahagian penggunaan model China pada platformnya meningkat kepada 55% pada bulan Ogos.

Washington Sedang Menonton

Lonjakan itu telah menarik perhatian jauh di luar komuniti pembangun. Daniel Remler, felo kanan dalam program teknologi dan keselamatan negara di Center for a New American Security, memberitahu CNBC bahawa AI China mewakili "risiko ekonomi dan keselamatan sebenar untuk Amerika Syarikat," memberi amaran terhadap penyepaduan model China ke dalam aliran kerja kritikal.

Pemeriksaan itu menambah lapisan kerumitan pada keluaran senyap MiniMax. Model yang tiba tanpa kad model, penilaian yang diterbitkan atau penetapan harga memberikan pembangun bebas kurang untuk bekerja apabila menilai kualiti dan keselamatan — walaupun produk makmal memperoleh bahagian penggunaan sebenar berbanding pesaing Amerika.

Mengapa Pelancaran Senyap Mungkin Strategik

Model pratonton berpagar di dalam produk syarikat sendiri ialah corak yang biasa: model tersebut menjana data penggunaan dan maklum balas sebelum keluaran API yang lebih luas, sambil mengehadkan pendedahan jika model tersebut berprestasi rendah. Untuk MiniMax, penampilan sulung M3.1-Flash-Preview yang disenyapkan juga mungkin menjadi cara untuk menjadi tumpuan untuk pelancaran yang lebih besar — ​​syarikat itu mempunyai lebih daripada dua kali ganda jualan kerana ia menyediakan model perdana baharu, menurut laporan yang dipetik oleh Startup Fortune.

Bagi pembangun, pengambilan praktikal adalah mudah: peringkat pengekodan pantas baharu daripada salah satu makmal terkemuka China kini disiarkan di dalam Kod MiniMax, dan penanda aras serta harga yang biasanya merangka keluaran sedemikian masih tiada. Sama ada M3.1-Flash-Preview boleh memanjangkan momentum yang membawa model Cina kepada bahagian majoriti trafik OpenRouter akan bergantung pada prestasinya sebaik sahaja pembangun mula menolak beban kerja sebenar melaluinya.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →