xAI a lansat Grok 4.7, cel mai capabil model al companiei pentru codare și munca de cunoștințe până în prezent, după săptămâni de tachinare publică și cel puțin o întârziere. Anunțat duminică pe site-ul companiei, modelul ajunge la același preț și viteză de servire ca și predecesorul său Grok 4.6: 2 USD per milion de jetoane de intrare și 6 USD per milion de jetoane de ieșire, aproximativ jumătate din prețul de listă al GPT-5.6 Sol Max de la OpenAI (4 USD/20 USD) și cu mult sub Fable Anthropic (101 USD/50 USD).

Pentru cele mai recente știri și analize AI, accesați AI Buzz Wire.

Un model de bază mai mare, pregătit pentru sarcini lungi

Conform anunțului xAI, Grok 4.7 folosește un model de bază nou, mai mare, în comparație cu Grok 4.6 și a fost antrenat cu o rulare mai lungă de învățare de întărire pe o combinație mai dificilă de sarcini, ponderate cu probleme care durează multe ore pentru a fi finalizate. Compania spune că modelul este mai bun în verificarea propriei activități și gestionarea contextului mai lung și că a fost instruit să înțeleagă în mod nativ hamul Grok Bot, îmbunătățind sarcinile conversaționale și munca de cunoștințe generale.

Lansarea urmează unei alergări zgomotoase. Elon Musk a spus mai întâi la începutul lunii septembrie că Grok 4.7 va ateriza în zece zile, apoi a recunoscut la jumătatea lunii septembrie că modelul are nevoie de încă câteva zile de perfecționare, potrivit TeslaNorth.com. Acum se livrează, iar GitHub a confirmat în aceeași zi că Grok 4.7 este disponibil în GitHub Copilot.

Imaginea de referință: puternică, nu măturatoare

Datele de referință publicate de xAI arată un model care conduce în mai multe categorii cu orizont lung, rămânând în același timp în urma celei mai scumpe configurații Anthropic față de altele:

  • CursorBench 4.0, care accentuează sarcinile de codare de lungă durată: Grok 4.7 are 46,3%, înaintea GPT-5.6 Sol Max (41,7%) și Grok 4.6 High (40,4%), dar în urma lui Fable 5.1 Max (51,8%).
  • Terminal-Bench 4.0, funcționare la terminale de mai multe ore: 38,0%, în creștere bruscă de la 20,3% pentru Grok 4.6 și chiar înaintea GPT-5.6 Sol Max (37,3%), deși Fable 5.1 Max conduce la 57,9%.
  • EEBench, un punct de referință în inginerie electrică: 64,0%, un salt mare față de 53,0% pentru Grok 4.6 și cel mai mare dintre modelele enumerate.
  • DeepSWE v1.1: 71,0% la efort mare, față de 65,2% pentru Grok 4.6 și 72,7% pentru GPT-5.6 Sol Max.
  • Servieta AA v1.1, muncă de birou de mai multe ore: 1.657, în creștere de la 1.546 și aproape de Fable 5.1 Max la 1.678.
  • Harvey Legal Agent Benchmark: 19,6%, înaintea Grok 4.6 (15.8%) și cu mult înaintea GPT-5.6 Sol Max (2.5%) și Fable 5.1 Max (6.7%) în această măsură.
  • HealthBench Professional: 56,7%, îmbunătățind față de Grok 4.6 cu 48,5%, dar în urmă cu GPT-5.6 Sol Max (60,5%) și Fable 5.1 Max (62,1%).

Pe GDPval, un punct de referință profesional pentru cunoștințe, punctat de Elo, graficul xAI îl plasează pe Grok 4.7 la un raționament xhigh pe 1.695 - în creștere de la 1.605 pentru Grok 4.6, în spatele lui Fable 5.1 Max (1.735) și înaintea GPT-6 Astra Max (1.542).

Prețul este povestea

Cea mai agresivă afirmație din anunț este mai degrabă economică decât tehnică: xAI descrie Grok 4.7 ca de două ori mai rapid la jumătate din prețul modelelor comparabile, iar tabelul de prețuri publicat susține comparația principală față de configurațiile de top ale celor doi rivali principali ai săi. Prețul tokenului de 2 USD/6 USD al Grok 4.7 este neschimbat față de Grok 4.6, ceea ce înseamnă că cumpărătorii beneficiază de îmbunătățirea generației peste generații fără o creștere a prețului.

Această poziționare extinde o strategie pe care xAI a urmat-o pe linia Grok 4.x: potrivirea sau abordarea calității de frontieră subcotând în același timp nivelurile de preț premium ale OpenAI și Anthropic, apoi distribuirea agresiv prin parteneri precum GitHub, Cursor și OpenRouter.

Ce să urmărești

Avertismentul sincer este că xAI a publicat diagrama de comparație în sine, iar verificarea independentă de la agregatorii de benchmarking va dura câteva zile. În ceea ce privește numerele pe care xAI a ales să le evidențieze, Grok 4.7 este un pas real față de Grok 4.6 – cel mai vizibil pe Terminal-Bench 4.0 și EEBench – dar nu mătură Fable 5.1 Max, care păstrează liderul la benchmark-urile de codare și sănătate, în timp ce costă de cinci ori mai mult pe token de ieșire.

Pentru dezvoltatorii care rulează sarcini de lucru agentice lungi, de mai multe ore, matematica preț-performanță poate conta mai mult decât poziția brută în clasament. Grok 4.7 este disponibil acum prin API-ul xAI și în GitHub Copilot.

Rămâi înaintea AI

Pentru o acoperire continuă a celor mai importante evoluții din industria AI, marcați AI Buzz Wire și nu ratați niciodată o poveste de ultimă oră.

Citiți mai multe știri AI