Laboratorium AI Tiongkok, Moonshot AI, meluncurkan Kimi K3 pada 16 Juli 2026, merilis apa yang disebutnya sebagai "model kelas 3T terbuka pertama di dunia" — sistem dengan 2,8 triliun parameter yang mempersempit kesenjangan dengan model eksklusif paling kuat dari Anthropic dan OpenAI. Peluncuran ini segera menjadi salah satu rilis AI yang paling banyak dibicarakan tahun ini, mencapai puncak Hacker News dan mendapat liputan dari Reuters, Bloomberg, dan The New York Times.

Untuk cakupan industri AI, Kimi K3 penting karena mendorong batas model open-weight jauh lebih tinggi sekaligus memaksakan perdebatan baru mengenai apakah sistem yang dapat diunduh secara gratis dapat menandingi sistem tertutup. Moonshot mengatakan bobot model lengkap akan dirilis pada 27 Juli 2026.

Model Terbuka 2,8 Triliun Parameter

Menurut pengumuman teknis Moonshot, Kimi K3 adalah model dengan parameter 2,8 triliun yang dibangun berdasarkan dua pembaruan arsitektur yang disebut perusahaan Kimi Delta Attention (KDA) dan Attention Residuals (AttnRes). Ia menggunakan desain Mixture-of-Experts (MoE) yang hanya mengaktifkan 16 dari 896 pakar untuk setiap token tertentu, dipasangkan dengan apa yang digambarkan Moonshot sebagai kerangka kerja Stable LatentMoE. Perusahaan mengklaim perubahan ini menghasilkan peningkatan sekitar 2,5x dalam efisiensi penskalaan secara keseluruhan dibandingkan dengan model Kimi K2 sebelumnya.

Model ini juga dilengkapi dengan kemampuan visi asli dan jendela konteks satu juta token. Analis Simon Willison, menulis di weblognya, mencatat bahwa Kimi K3 mengambil mahkota ukuran terbuka dari DeepSeek dengan 1,6 triliun parameter v4 Pro — "lebih dari dua kali ukuran" dari Kimi K2.6 dengan parameter 1 triliun yang mendahuluinya.

Moonshot menggambarkan rilis ini sebagai langkah terbaru dalam upaya penskalaan yang berkelanjutan, dengan menyatakan bahwa selama sembilan dari dua belas bulan terakhir, model-modelnya telah menetapkan batas atas ukuran model terbuka.

Perbandingannya pada Tolok Ukur

Rangkaian evaluasi Moonshot sendiri menempatkan kinerja keseluruhan Kimi K3 di belakang hanya dua sistem berpemilik — Claude Fable 5 dari Anthropic dan GPT-5.6 Sol dari OpenAI — sementara itu secara konsisten mengungguli model lain yang diuji, termasuk Claude Opus 4.8 dan GPT-5.5. Analisis pihak ketiga secara luas melacak klaim-klaim tersebut.

Layanan evaluasi independen Analisis Buatan melaporkan bahwa pada tolok ukur kerja pengetahuan jangka panjang pribadinya, Kimi K3 mencapai Elo keseluruhan sebesar 1547 — melonjak 732 poin atas Kimi K2.6 dan hanya tertinggal dari Claude Fable 5. Di arena Kode Frontend Arena.ai, Kimi K3 naik ke posisi nomor satu, bahkan melampaui Claude Fable 5, menurut postingan papan peringkat yang beredar luas setelah peluncuran.

Penetapan harga adalah bagian penting dari cerita ini. Analisis Buatan mematok biaya rata-rata per tugas sebesar $0,94, sebanding dengan $1,04 dari GPT-5.6 Sol dan sekitar setengah dari $1,80 dari Claude Opus 4.8, sambil mencatat bahwa Kimi K3 menggunakan token keluaran 21% lebih sedikit dibandingkan pendahulunya. Berdasarkan per token, model ini dihargai $3 per juta token masukan dan $15 per juta token keluaran — tingkat yang sama dengan seri Claude Sonnet dari Anthropic dan, seperti pengamatan Willison, model termahal yang dirilis oleh laboratorium AI Tiongkok hingga saat ini, naik dari Kimi K2.6 yang seharga $0,95/$4.

Pengodean Agentik dan Kompiler yang Dibuat Sendiri

Sebagian besar pengumuman Moonshot tidak berfokus pada tolok ukur chatbot tetapi pada tugas agen jangka panjang. Perusahaan mengatakan Kimi K3 dapat mempertahankan sesi teknik yang diperpanjang, menavigasi repositori kode yang besar, dan mengatur alat terminal dengan pengawasan manusia yang minimal.

Dalam salah satu demonstrasi, Moonshot mengatakan versi awal Kimi K3 menangani sebagian besar pekerjaan optimasi kernel GPU milik tim selama pengembangan tahap akhir. Di model lain, model tersebut membuat "MiniTriton", kompiler GPU mirip Triton yang ringkas dengan representasi perantara tingkat ubin, jalur pengoptimalan, dan jalur pembuatan kode PTX. Moonshot mengklaim MiniTriton menyamai atau mengalahkan Triton dan torch yang sudah ada. Kompilasi tumpukan pada tolok ukur garis atap yang didukung dan pelatihan nanoGPT ujung ke ujung yang berkelanjutan dengan konvergensi yang stabil.

Perusahaan juga memamerkan bukti konsep yang mencolok dalam desain chip. Dalam satu kali pengoperasian otonom selama 48 jam, Kimi K3 dilaporkan merancang, mengoptimalkan, dan memverifikasi chip yang dibuat untuk melayani model nano pada arsitekturnya sendiri, menggunakan alat EDA sumber terbuka di perpustakaan Nangate 45nm. Moonshot mengatakan desain tersebut menutup waktu pada 100 MHz dalam 4 mm² dan menopang lebih dari 8,700 token per detik throughput dekode dalam simulasi.

Di sisi penelitian, Moonshot mengatakan Kimi K3 mereproduksi hubungan universal I-Love-Q dari astrofisika komputasi dalam waktu sekitar dua jam – pekerjaan yang diperkirakan perusahaan biasanya membutuhkan waktu satu hingga dua minggu bagi peneliti – dengan memvalidasi silang lebih dari 20 makalah, menerapkan pipeline numerik penuh di lebih dari 300 persamaan keadaan, dan menulis lebih dari 3.000 baris Python.

Debat Kelas Terbuka Kembali

Kedatangan Kimi K3 menghidupkan kembali perdebatan yang telah berlangsung hingga tahun 2026 karena laboratorium Tiongkok telah berulang kali menutup – atau tampak menutup – jarak dengan model-model perbatasan AS. Polanya kini sudah lazim: rilis di Tiongkok menampilkan angka yang dilaporkan sendiri di dekat bagian atas papan peringkat, laboratorium di Barat menekankan keunggulan kepemilikan mereka yang masih terus berkembang, dan dunia usaha mempertimbangkan biaya dan keterbukaan dibandingkan dengan kemampuan mentah.

Ketegangan itu terlihat dalam penetapan harga. Model yang memotong biaya per tugas Claude Opus 4.8 dan mendekati kemampuannya, namun mengenakan biaya lebih mahal dibandingkan rilisan Tiongkok sebelumnya, mencerminkan keyakinan Moonshot bahwa ia dapat memberikan harga premium bahkan dalam ekosistem terbuka. Willison memperingatkan agar tidak terlalu banyak membaca tolok ukur apa pun – tes “pelikan di atas sepeda” yang sudah berjalan lama, tulisnya, tidak lagi memiliki korelasi yang dapat diandalkan dengan kualitas dunia nyata – namun mengatakan bahwa rilis tersebut masih memberikan penghargaan pada pengujian langsung.

Kimi K3 sekarang tersedia melalui Kimi.com, agen desktop Kimi Work, alat pengembang Kimi Code, dan Kimi API. Moonshot mengatakan pihaknya bekerja sama dengan mitra inferensi dan pengelola sumber terbuka untuk memastikan peluncuran yang andal sebelum rilis bobot penuh.

Tetap Terdepan dalam AI

Untuk liputan berkelanjutan mengenai rilis model, pertarungan benchmark, dan pertarungan open-weight, ikuti AI Buzz Wire untuk mengetahui perkembangan yang membentuk perlombaan kecerdasan buatan global.

Baca lebih lanjut berita model AI →