MiniMax, laboratorium AI Tiongkok, telah mengambil pendekatan yang tidak biasa terhadap rilis terbarunya: mereka nyaris tidak mengakuinya. Pada tanggal 27 September, akun resmi perusahaan mengonfirmasi apa yang telah dilihat pengembang pada produk tersebut — model baru bernama M3.1-Flash-Preview telah tersedia di dalam MiniMax Code, asisten pengkodean perusahaan. Sejauh itulah peluncurannya: tidak ada kartu model, tidak ada tabel patokan, tidak ada harga per juta token.
Pengamat AI Tiongkok di X telah memperhatikan model tersebut muncul di produk sebelum konfirmasi, menurut Startup Fortune. Peluncuran yang diredam ini sangat kontras dengan cara MiniMax mengirimkan produk andalan terakhirnya. For more context on this story, see our ongoing breaking AI news.
Debut yang Sengaja Diam-diam
Ketika MiniMax meluncurkan M3 pada bulan Juni, perusahaan menerbitkan rincian arsitektur, skor SWE-bench, dan lembar harga yang melemahkan pesaingnya sebesar 90%. Kali ini, titik akhir API untuk M3.1-Flash-Preview dilindungi keamanannya, dan satu-satunya cara untuk mencoba model tersebut adalah di dalam produk MiniMax sendiri, dengan jejak penalaran dan perilaku sebagai sinyal utama yang dapat diamati.
Strategi sederhana ini menunjukkan bahwa MiniMax mungkin memperlakukan rilis tersebut tidak seperti peluncuran berita utama dan lebih seperti eksperimen: pengujian A/B terhadap fitur produk dan membiarkan internet mengetahuinya. Hal ini dapat mencerminkan keyakinan bahwa model tersebut akan membuktikan dirinya sendiri setelah pengembang menggunakannya — atau sekadar bahwa rilis ini bukanlah rilis yang besar, namun merupakan tingkatan pendamping yang lebih cepat dan lebih murah.
Apa yang Diceritakan oleh Basis M3 kepada Kita
Model dasar M3 menawarkan gambaran tentang apa yang dapat dikirimkan MiniMax ketika ia membutuhkan perhatian. Ini adalah model campuran ahli dengan 428 miliar parameter dengan sekitar 23 miliar parameter aktif per token, jendela konteks satu juta token, dan input gambar dan video asli. Di bangku SWE Terverifikasi, MiniMax melaporkan skor 80,5%.
Flash adalah versi lini yang dibuat untuk mempertajam keunggulan kecepatan dan harga untuk pengkodean sehari-hari — perbaikan bug cepat dan pekerjaan fitur kecil yang dijalankan pengembang puluhan kali sehari, dibandingkan tugas agen jangka panjang yang disediakan untuk produk andalan. Memisahkan lini model dengan cara ini, dengan versi frontier yang besar dan pendamping yang cepat dan murah, telah menjadi pedoman standar di antara laboratorium Tiongkok yang bersaing untuk mendapatkan mindshare pengembang.
Pengiriman Ke Medan Yang Ramai
MiniMax tidak dirilis ke pasar yang sepi. Alibaba meluncurkan Qwen3.8-Max pada tanggal 3 Agustus — produk andalan dengan 2,4 triliun parameter dengan harga $2 per juta token input — kemudian diikuti pada tanggal 12 Agustus dengan versi open-weight pertama dari model Max-tier Qwen. GLM-5.3 Zhipu mendarat pada 14 Agustus dengan jendela konteks sejuta tokennya sendiri.
Pengembang telah memperhatikan membanjirnya pilihan yang mumpuni dan murah. Menurut laporan CNBC tentang data OpenRouter, model Tiongkok menyumbang 57% hingga 67% dari total penggunaan token pada platform selama seminggu yang mencakup tanggal 14 September — naik dari hanya 6% menjadi 13% pada bulan Februari. Vercel juga mengalami lonjakan serupa, dengan pangsa penggunaan model Tiongkok pada platformnya meningkat menjadi 55% pada bulan Agustus.
Washington Sedang Menonton
Lonjakan ini telah menarik perhatian lebih dari sekadar komunitas pengembang. Daniel Remler, peneliti senior di bidang teknologi dan program keamanan nasional di Center for a New American Security, mengatakan kepada CNBC bahwa AI Tiongkok mewakili “risiko ekonomi dan keamanan nyata bagi Amerika Serikat,” memperingatkan agar tidak mengintegrasikan model Tiongkok ke dalam alur kerja penting.
Pengawasan itu menambah lapisan kompleksitas pada rilis diam-diam MiniMax. Model yang hadir tanpa kartu model, evaluasi yang dipublikasikan, atau harga membuat pengembang independen tidak bisa bekerja sama ketika menilai kualitas dan keamanan — bahkan ketika produk laboratorium mendapatkan pangsa penggunaan yang nyata dibandingkan produk pesaingnya di Amerika.
Mengapa Peluncuran Diam-diam Mungkin Bersifat Strategis
Model pratinjau yang ditempatkan di dalam produk milik perusahaan merupakan pola yang lazim: model pratinjau menghasilkan data penggunaan dan masukan sebelum rilis API yang lebih luas, sekaligus membatasi paparan jika model berperforma buruk. Untuk MiniMax, debut M3.1-Flash-Preview yang diredam juga dapat menjadi cara untuk mempertahankan sorotan untuk peluncuran yang lebih besar — perusahaan ini memiliki penjualan lebih dari dua kali lipat saat mereka mempersiapkan model andalan baru, menurut laporan yang dikutip oleh Startup Fortune.
Bagi para pengembang, hal praktis yang dapat diambil sangatlah sederhana: tingkat pengkodean cepat baru dari salah satu laboratorium terkemuka di Tiongkok kini tersedia di dalam MiniMax Code, dan tolok ukur serta harga yang biasanya membingkai rilis semacam itu masih belum ada. Apakah M3.1-Flash-Preview dapat memperluas momentum yang membawa model Tiongkok ke sebagian besar lalu lintas OpenRouter akan bergantung pada bagaimana kinerjanya setelah pengembang mulai mendorong beban kerja nyata melaluinya.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →