xAI telah merilis Grok 4.6, iterasi terbaru dari model bahasa besar perbatasannya, dengan skor 61 pada Indeks Kecerdasan Analisis Buatan untuk menyamai Sol GPT-5.6 OpenAI. Model ini diluncurkan hari ini dan segera tersedia di Cursor dan Grok Build, dengan akses API dan integrasi mitra melalui OpenRouter, Vercel, dan Cloudflare.

Untuk berita dan analisis AI terkini, kunjungi AI Buzz Wire.

Kecerdasan Perbatasan dengan Biaya yang Sangat Rendah

Menurut Analisis Buatan, sebuah platform pembandingan independen, Grok 4.6 memperoleh lima poin dibandingkan pendahulunya Grok 4.5 pada Indeks Intelijen, membawa xAI kembali ke tingkat terdepan bersama OpenAI. Model tersebut berada tepat di belakang Claude Opus 5 (63) dan Claude Fable 5 (62) dari Anthropic, dan di depan Kimi K3.

Apa yang membuat Grok 4.6 menonjol adalah harganya. Harga utama tetap tidak berubah dari Grok 4.5 dengan harga $2 per juta token masukan dan $6 per juta token keluaran. Itu menempatkannya lebih dari 60% di bawah Claude Opus 5 ($5/$25) dan GPT-5.6 Sol ($5/$30). Biaya terukur per tugas adalah $0,84, menempatkannya pada batas Intelegensi versus Biaya Pareto.

Mempertahankan harga yang tetap pada satu generasi merupakan hal yang tidak biasa di negara-negara terdepan, dimana peningkatan intelijen biasanya dibarengi dengan kenaikan harga. Grok 4.6 memberikan kenaikan Indeks Intelijen lima poin dengan harga yang tidak berubah.

Dibuat untuk Agen yang Sudah Berjalan Lama

Grok 4.6 dibangun di atas Grok 4.5 dengan apa yang digambarkan xAI sebagai fokus khusus pada agen yang sudah berjalan lama dan pekerjaan interaktif dan visual yang lebih ambisius. Perusahaan mengatakan model tersebut mampu menangani tugas-tugas kompleks dalam banyak langkah, baik meneliti suatu topik, menganalisis informasi, mengerjakan basis kode, atau mengubah ide menjadi aplikasi yang sempurna.

Tolok ukur yang bersifat agen menceritakan kisah yang menarik. Pada GDPval-AA v2, ukuran terdepan dari karya pengetahuan agen dunia nyata, Grok 4.6 mencapai Elo tahun 1753, hanya di belakang Claude Opus 5 dan secara statistik setara dengan Claude Fable 5 dan Qwen3.8 Max. Ia mendapat skor 50,7% pada tolok ukur Tau-cubed Banking untuk layanan pelanggan multi-turn, menempatkannya di dua teratas bersama Qwen3.8 Max.

Pada CursorBench v3.2, Grok 4.6 mendapat skor 69,9%, mengungguli GPT-5.6 Sol (67,2%) dan Grok 4.5 (66,7%). Ini memposting 65,9% di DeepSWE v1.1 dan 61,3% di FrontierCode v1.1 Extended.

Efisiensi Putaran Luar Biasa

Salah satu temuan menonjol dari Analisis Buatan adalah profil efisiensi Grok 4.6 pada AA-Briefcase, sebuah tolok ukur pribadi untuk tugas kerja pengetahuan agen jangka panjang. Model ini memulai debutnya dengan Elo tahun 1577, menempatkannya di tingkat Fable 5.

Angka efisiensinya sangat mencengangkan. Grok 4.6 menyelesaikan tugas dalam sekitar 53 putaran dan rata-rata 0,5 miliar token masukan, dibandingkan dengan sekitar 103 putaran dan 2,0 miliar token masukan untuk Claude Opus 5 maks. Karena pekerjaan agen jangka panjang mengumpulkan konteks dengan cepat, model yang mencapai jawaban yang sebanding dalam separuh putaran dan seperempat token masukan memiliki keunggulan biaya yang jauh melebihi harga per tokennya.

Pelatihan dan Keamanan

Grok 4.6 menjalani pelatihan tambahan yang lebih lama dibandingkan Grok 4.5, dengan data hasil kurasi model untuk penalaran dan konsep teknis tingkat lanjut, data teknik berkualitas tinggi, serta pengoptimal dan resep pelatihan yang ditingkatkan. xAI menggunakan Grok 4.5 untuk membuat ulang lintasan SFT di seluruh upaya penalaran, pemanfaatan agen, dan domain termasuk STEM, rekayasa perangkat lunak, dan pekerjaan pengetahuan.

Model ini membawa jendela konteks 500.000 token, tidak berubah dari Grok 4.5. xAI melaporkan bahwa Grok 4.6 menjalani rangkaian pengujian pra-penerapan terluas untuk kemampuan dan kalibrasi perlindungan, bersama dengan pengujian ekstensif pasca-penerapan dan pihak ketiga.

Ketersediaan dan Harga

Grok 4.6 saat ini tersedia di Cursor dan Grok Build. xAI menawarkan penggunaan ganda yang disertakan dalam kedua platform untuk minggu pertama. Harga mulai dari $2 per juta token masukan dan $6 per juta token keluaran, dengan varian cepat tersedia dengan harga dua kali lipat. Cache hit didiskon menjadi $0,50 per juta token.

Peluncuran ini melanjutkan irama cepat untuk xAI, dengan Grok 4.6 hadir sebulan setelah Grok 4.5. Model ini memposisikan xAI sebagai pesaing serius dalam persaingan terdepan, khususnya bagi pengembang yang memprioritaskan kinerja agen dan efisiensi biaya.

Tetap Terdepan dalam AI

Untuk liputan berkelanjutan mengenai perkembangan paling penting dalam industri AI, tandai AI Buzz Wire dan jangan pernah melewatkan berita terkini.

Baca berita AI selengkapnya