xAI wis ngrilis Grok 4.7, model perusahaan sing paling mumpuni kanggo kerja coding lan kawruh nganti saiki, sawise pirang-pirang minggu nggodha umum lan paling ora ana wektu tundha. Diumumake ing situs perusahaan ing dina Minggu, model kasebut ndharat kanthi rega sing padha lan kacepetan porsi kaya sing sadurunge Grok 4.6: $ 2 saben yuta token input lan $ 6 saben yuta token output, kira-kira setengah rega dhaptar OpenAI's GPT-5.6 Sol Max ($ 4 / $ 20) lan ana ing sangisore Fable Anthropic 5.150 ($ 10 / $ 150 Max).

Kanggo warta lan analisis AI paling anyar, bukak AI Buzz Wire.

Model Dasar sing luwih gedhe, Dilatih kanggo Tugas sing dawa

Miturut woro-woro xAI, Grok 4.7 nggunakake model basis anyar sing luwih gedhe dibandhingake karo Grok 4.6 lan dilatih kanthi sinau penguatan sing luwih dawa ing campuran tugas sing luwih angel, bobote kanggo masalah sing butuh pirang-pirang jam kanggo ngrampungake. Perusahaan kasebut ujar manawa model kasebut luwih apik kanggo verifikasi karyane dhewe lan ngatur konteks sing luwih dawa, lan dilatih kanggo ngerti asline Grok Bot, nambah tugas obrolan lan kerja pengetahuan umum.

Release nderek run-up rame. Elon Musk pisanan ngandika ing awal September sing Grok 4.7 bakal ndharat ing sepuluh dina, banjur ngakoni ing pertengahan September sing model mbutuhake sawetara dina refinement, miturut TeslaNorth.com. Saiki dikirim, lan GitHub dikonfirmasi ing dina sing padha yen Grok 4.7 kasedhiya ing GitHub Copilot.

Gambar Patokan: Kuwat, Ora Nyapu

Data pathokan sing diterbitake xAI nuduhake model sing mimpin ing sawetara kategori long-horizon nalika isih ana ing mburi konfigurasi Anthropic sing paling larang kanggo liyane:

  • CursorBench 4.0, kang nandheske tugas coding maneh-mlaku: Grok 4,7 skor 46,3%, ahead saka GPT-5,6 Sol Max (41,7%) lan Grok 4,6 Dhuwur (40,4%), nanging konco Fable 5,1 Max (51,8%).
  • Terminal-Bench 4.0, karya terminal multi-jam: 38,0%, munggah banget saka 20,3% kanggo Grok 4,6 lan mung sadurunge GPT-5,6 Sol Max (37,3%), sanadyan Fable 5,1 Max ndadékaké ing 57,9%.
  • EEBench, pathokan teknik listrik: 64,0%, lompat gedhe saka Grok 4,6 53,0% lan paling dhuwur saka model sing kadhaptar.
  • DeepSWE v1.1: 71,0% ing dhuwur efforts , mungsuh 65,2% kanggo Grok 4,6 lan 72,7% kanggo GPT-5,6 Sol Max.
  • AA Briefcase v1.1, karya kantor multi-jam: 1.657, munggah saka 1.546, lan cedhak konco Fable 5.1 Max ing 1.678.
  • Benchmark Agen Legal Harvey: 19,6%, sadurunge Grok 4,6 (15,8%) lan adoh saka GPT-5,6 Sol Max (2,5%) lan Fable 5,1 Max (6,7%) ing langkah iki.
  • HealthBench Professional: 56,7%, nambah ing Grok 4,6 kang 48,5% nanging mburi GPT-5,6 Sol Max (60,5%) lan Fable 5,1 Max (62,1%).

Ing GDPval, pathokan kerja kawruh profesional sing dicetak dening Elo, grafik xAI nempatake Grok 4.7 kanthi alasan xhigh ing 1,695 - saka 1,605 kanggo Grok 4.6, ing mburi Fable 5.1 Max (1,735) lan luwih saka GPT-6 Astra Max (1,542).

Rega Iku Crita

Pratelan sing paling agresif ing woro-woro kasebut yaiku ekonomi tinimbang teknis: xAI nggambarake Grok 4.7 kanthi cepet kaping pindho kanthi setengah rega model sing bisa dibandhingake, lan tabel rega sing diterbitake ndhukung perbandingan judhul karo konfigurasi tingkat paling dhuwur saka rong pesaing utama. Rega token $ 2 / $ 6 Grok 4.7 ora owah saka Grok 4.6, tegese para panuku entuk dandan generasi-liwat tanpa kenaikan rega.

Posisi kasebut ngluwihi strategi sing ditindakake xAI ing garis Grok 4.x: cocog utawa nyedhaki kualitas wates nalika nyuda tingkat rega premium OpenAI lan Anthropic, banjur disebarake kanthi agresif liwat mitra kalebu GitHub, Cursor, lan OpenRouter.

Apa kanggo Watch

Caveat sing jujur yaiku xAI nerbitake grafik perbandingan dhewe, lan verifikasi independen saka agregator benchmarking bakal butuh sawetara dina. Ing nomer xAI milih kanggo nyorot, Grok 4.7 minangka langkah asli saka Grok 4.6 - paling katon ing Terminal-Bench 4.0 lan EEBench - nanging ora nyapu Fable 5.1 Max, sing nahan timbal ing coding lan pathokan kesehatan nalika regane kaping lima luwih saben token output.

Kanggo pangembang sing nglakokake beban kerja agen sing dawa lan pirang-pirang jam, matematika kinerja rega bisa uga luwih penting tinimbang posisi leaderboard mentah. Grok 4.7 kasedhiya saiki liwat xAI's API lan ing GitHub Copilot.

Tetep Ahead saka AI

Kanggo jangkoan terus-terusan babagan perkembangan industri AI sing paling penting, tandhani tetenger AI Buzz Wire lan aja nganti kantun crita sing nggegirisi.

Waca liyane warta AI