xAI wis dirilis Grok 4.6, pengulangan paling anyar saka model basa gedhe wates sawijining, ngetung 61 ing Artificial Analysis Intelligence Index kanggo cocog OpenAI kang GPT-5.6 Sol. Model kasebut diluncurake dina iki lan kasedhiya langsung ing Cursor lan Grok Build, kanthi akses API lan integrasi mitra liwat OpenRouter, Vercel, lan Cloudflare.
Kanggo warta lan analisis AI paling anyar, bukak AI Buzz Wire.
Intelligence Frontier ing Fraksi saka Biaya
Miturut Analisis Artificial, platform benchmarking independen, Grok 4.6 entuk limang poin tinimbang sadurunge Grok 4.5 ing Indeks Intelijen, nggawa xAI bali menyang tingkat wates bebarengan karo OpenAI. Model kasebut ana ing mburi Claude Opus 5 (63) lan Claude Fable 5 (62) Anthropic, lan ing ngarep Kimi K3.
Sing nggawe Grok 4.6 utamane yaiku regane. Rega utama tetep ora owah saka Grok 4.5 ing $2 saben yuta token input lan $6 saben yuta token output. Sing sijine iku luwih saka 60% ngisor Claude Opus 5 ($5/$25) lan GPT-5,6 Sol ($5/$30). Biaya sing diukur saben tugas yaiku $ 0,84, dilebokake ing wates Intelligence versus Cost Pareto.
Nyekel rega rata-rata ing sawijining generasi ora biasa ing wates, ing ngendi keuntungan intelijen biasane diiringi kenaikan rega. Grok 4.6 menehi gain Indeks Intelijen limang poin kanthi rega sing ora owah.
Dibangun kanggo Agen Long-Running
Grok 4.6 dibangun ing Grok 4.5 karo apa xAI diterangake minangka fokus tartamtu ing agen long-mlaku lan liyane ambisi karya interaktif lan visual. Perusahaan kasebut ujar manawa model kasebut tetep nindakake tugas sing rumit ing pirang-pirang langkah, apa riset topik, nganalisa informasi, nggarap basis kode, utawa ngowahi ide dadi aplikasi sing dipoles.
Tolok ukur agenik nyritakake crita sing menarik. Ing GDPval-AA v2, ukuran anjog saka karya kawruh agen nyata ing donya, Grok 4.6 entuk Elo saka 1753, konco mung Claude Opus 5 lan statistik ing par karo Claude Fable 5 lan Qwen3.8 Max. Skor 50,7% ing tau-cubed Banking benchmark kanggo layanan pelanggan multi-giliran, manggonke ing ndhuwur loro bebarengan Qwen3.8 Max.
Ing CursorBench v3.2, Grok 4,6 skor 69,9%, ahead saka loro GPT-5,6 Sol (67,2%) lan Grok 4,5 (66,7%). Iki ngirim 65,9% ing DeepSWE v1.1 lan 61,3% ing FrontierCode v1.1 Extended.
Efisiensi Nguripake Apik banget
Salah sawijining temuan sing luar biasa saka Analisis Artificial yaiku profil efisiensi Grok 4.6 ing AA-Briefcase, pathokan pribadi tugas kerja pengetahuan agenik sing dawa. Model debut karo Elo saka 1577, manggonke ing Fable 5 undakan.
Nomer efisiensi sing striking. Grok 4.6 ngrampungake tugas ing kira-kira 53 giliran lan 0.5 milyar input token rata-rata, dibandhingake kira-kira 103 giliran lan 2.0 milyar input token kanggo Claude Opus 5 max. Wiwit karya agen long-horizon accumulates konteks kanthi cepet, model sing tekan jawaban iso dibandhingke ing setengah giliran lan seprapat saka token input duwe kauntungan biaya uga ngluwihi reregan saben-token.
Latihan lan Keamanan
Grok 4.6 ngalami latihan tambahan sing luwih dawa tinimbang Grok 4.5, kanthi data sing digawe model sing dikurasi kanggo alasan lan konsep teknis sing canggih, data teknik bermutu tinggi, lan resep pangoptimal lan latihan sing luwih apik. xAI nggunakake Grok 4.5 kanggo regenerasi lintasan SFT liwat upaya penalaran, harness agen, lan domain kalebu STEM, rekayasa piranti lunak, lan karya kawruh.
Model kasebut ngemot jendela konteks 500.000-token, ora owah saka Grok 4.5. xAI nglaporake manawa Grok 4.6 ngalami uji coba pra-penyebaran sing paling akeh kanggo kapabilitas lan kalibrasi njaga, bebarengan karo panyebaran ekstensif lan tes pihak katelu.
Kasedhiyan lan Rega
Grok 4.6 kasedhiya saiki ing Cursor lan Grok Build. xAI nawakake panggunaan kaping pindho ing loro platform kanggo minggu pisanan. Rega diwiwiti kanthi $2 saben yuta token input lan $6 saben yuta token output, kanthi varian cepet kasedhiya ing rega kaping pindho. Cache hits sing diskon kanggo $0,50 saben yuta token.
Rilis kasebut nerusake irama cepet kanggo xAI, kanthi Grok 4.6 tekan luwih saka sewulan sawise Grok 4.5. Model kasebut posisi xAI minangka pesaing serius ing balapan perbatasan, utamane kanggo pangembang sing ngutamakake kinerja agen lan efisiensi biaya.
Tetep Ahead saka AI
Kanggo jangkoan terus-terusan babagan perkembangan industri AI sing paling penting, tandhani tetenger AI Buzz Wire lan aja nganti kantun crita sing nggegirisi.
Waca liyane warta AI