xAI telah mengeluarkan Grok 4.6, lelaran terkini model bahasa besar sempadannya, menjaringkan 61 pada Indeks Kecerdasan Analisis Buatan untuk menyamai GPT-5.6 Sol OpenAI. Model ini dilancarkan hari ini dan tersedia serta-merta dalam Cursor dan Grok Build, dengan akses API dan integrasi rakan kongsi melalui OpenRouter, Vercel dan Cloudflare.

Untuk berita terkini dan analisis AI, lawati AI Buzz Wire.

Perisikan Sempadan pada Pecahan Kos

Menurut Analisis Buatan, platform penanda aras bebas, Grok 4.6 memperoleh lima mata berbanding pendahulunya Grok 4.5 pada Indeks Perisikan, membawa xAI kembali ke peringkat sempadan bersama OpenAI. Model itu duduk betul-betul di belakang Claude Opus 5 (63) dan Claude Fable 5 (62) karya Anthropic, dan di hadapan Kimi K3.

Apa yang menjadikan Grok 4.6 amat ketara ialah harganya. Harga tajuk kekal tidak berubah daripada Grok 4.5 pada $2 setiap juta token input dan $6 setiap juta token keluaran. Itu meletakkannya lebih daripada 60% di bawah Claude Opus 5 ($5/$25) dan GPT-5.6 Sol ($5/$30). Kos yang diukur setiap tugas ialah $0.84, meletakkannya pada sempadan Perisikan lawan Kos Pareto.

Mengekalkan harga rata merentasi generasi adalah luar biasa di sempadan, di mana keuntungan risikan lazimnya disertai dengan kenaikan harga. Grok 4.6 memberikan keuntungan Indeks Perisikan lima mata pada harga yang tidak berubah.

Dibina untuk Ejen Beroperasi Lama

Grok 4.6 dibina di atas Grok 4.5 dengan perkara yang diterangkan oleh xAI sebagai tumpuan khusus pada ejen jangka panjang dan kerja interaktif dan visual yang lebih bercita-cita tinggi. Syarikat itu berkata model itu kekal dengan tugas yang kompleks merentasi banyak langkah, sama ada menyelidik topik, menganalisis maklumat, bekerja merentasi pangkalan kod atau mengubah idea menjadi aplikasi yang digilap.

Penanda aras agen menceritakan kisah yang menarik. Pada GDPval-AA v2, ukuran utama kerja pengetahuan ejen dunia sebenar, Grok 4.6 mencapai Elo 1753, di belakang hanya Claude Opus 5 dan secara statistik setanding dengan Claude Fable 5 dan Qwen3.8 Max. Ia mendapat markah 50.7% pada penanda aras Perbankan tau-cubed untuk perkhidmatan pelanggan berbilang pusingan, meletakkannya dalam dua teratas bersama Qwen3.8 Max.

Pada CursorBench v3.2, Grok 4.6 mendapat 69.9%, mendahului kedua-dua GPT-5.6 Sol (67.2%) dan Grok 4.5 (66.7%). Ia menyiarkan 65.9% pada DeepSWE v1.1 dan 61.3% pada FrontierCode v1.1 Extended.

Kecekapan Giliran yang Luar Biasa

Salah satu penemuan yang menonjol daripada Analisis Buatan ialah profil kecekapan Grok 4.6 pada AA-Briefcase, penanda aras persendirian bagi tugas kerja pengetahuan agenik ufuk panjang. Model ini muncul dengan Elo 1577, meletakkannya di peringkat Fable 5.

Nombor kecekapan sangat menarik. Grok 4.6 menyelesaikan tugas dalam kira-kira 53 pusingan dan 0.5 bilion token input secara purata, berbanding kira-kira 103 pusingan dan 2.0 bilion token input untuk Claude Opus 5 maks. Memandangkan kerja agenik ufuk panjang mengumpul konteks dengan cepat, model yang mencapai jawapan yang setanding pada separuh pusingan dan satu perempat daripada token input mempunyai kelebihan kos jauh melebihi harga per tokennya.

Latihan dan Keselamatan

Grok 4.6 menjalani latihan tambahan yang lebih lama daripada Grok 4.5, dengan data yang dijana model dipilih susun untuk penaakulan dan konsep teknikal lanjutan, data kejuruteraan berkualiti tinggi serta pengoptimuman dan resipi latihan yang dipertingkatkan. xAI menggunakan Grok 4.5 untuk menjana semula trajektori SFT merentas usaha penaakulan, memanfaatkan ejen dan domain termasuk STEM, kejuruteraan perisian dan kerja pengetahuan.

Model ini membawa tetingkap konteks 500,000 token, tidak berubah daripada Grok 4.5. xAI melaporkan bahawa Grok 4.6 telah menjalani rangkaian ujian pra-pengerahan terluas untuk keupayaan dan penentukuran perlindungan, bersama-sama dengan ujian pasca-pengerahan dan pihak ketiga yang meluas.

Ketersediaan dan Harga

Grok 4.6 tersedia hari ini dalam Cursor dan Grok Build. xAI menawarkan penggunaan termasuk dua kali ganda dalam kedua-dua platform untuk minggu pertama. Harga bermula pada $2 setiap juta token input dan $6 setiap juta token keluaran, dengan varian pantas tersedia pada dua kali ganda harga. Hit cache didiskaunkan kepada $0.50 setiap juta token.

Keluaran itu meneruskan irama pantas untuk xAI, dengan Grok 4.6 tiba lebih sebulan selepas Grok 4.5. Model ini meletakkan xAI sebagai pesaing yang serius dalam perlumbaan sempadan, terutamanya bagi pemaju yang mengutamakan prestasi agen dan kecekapan kos.

Kekal Mendahului AI

Untuk liputan berterusan mengenai perkembangan industri AI yang paling penting, tandai halaman AI Buzz Wire dan jangan pernah terlepas kisah penting.

Baca lebih banyak berita AI