xAI imetoa Grok 4.7, kielelezo chenye uwezo zaidi wa kampuni cha kuweka usimbaji na kazi ya maarifa kufikia sasa, baada ya wiki za kudhihaki hadharani na angalau kucheleweshwa mara moja. Iliyotangazwa kwenye tovuti ya kampuni siku ya Jumapili, modeli hiyo inatua kwa bei sawa na kasi ya kuhudumia kama mtangulizi wake Grok 4.6: $ 2 kwa tokeni za pembejeo milioni na $ 6 kwa tokeni za pato milioni, takriban nusu ya bei ya orodha ya OpenAI's GPT-5.6 Sol Max ($ 4/$20) na chini ya Anthropic's Fable 10/5 $ 5.1 Max $.

Kwa habari mpya zinazochipuka za AI na uchambuzi, tembelea AI Buzz Wire.

Muundo Kubwa wa Msingi, Uliofunzwa kwa Majukumu Marefu

Kulingana na tangazo la xAI, Grok 4.7 hutumia modeli mpya, kubwa zaidi ya msingi ikilinganishwa na Grok 4.6 na ilifunzwa kwa mafunzo ya uimarishaji ya muda mrefu juu ya mseto mgumu zaidi wa majukumu, yenye uzito kuelekea matatizo ambayo huchukua saa nyingi kukamilika. Kampuni hiyo inasema modeli hiyo ni bora zaidi katika kuthibitisha kazi yake yenyewe na kudhibiti muktadha mrefu, na kwamba ilifunzwa kuelewa asili ya kuunganisha Grok Bot, kuboresha kazi za mazungumzo na kazi ya maarifa ya jumla.

Utoaji huo unafuatia kukimbia kwa kelele. Elon Musk kwanza alisema mapema Septemba kwamba Grok 4.7 ingetua ndani ya siku kumi, kisha akakubali katikati ya Septemba kwamba mtindo huo unahitaji siku chache zaidi za uboreshaji, kulingana na TeslaNorth.com. Sasa inasafirishwa, na GitHub ilithibitisha siku hiyo hiyo kwamba Grok 4.7 inapatikana katika GitHub Copilot.

Picha ya Kulinganisha: Imara, Sio Kufagia

Data ya ulinganifu iliyochapishwa na xAI inaonyesha modeli inayoongoza katika kategoria kadhaa za upeo wa macho huku ikisalia nyuma ya usanidi wa gharama kubwa zaidi wa Anthropic kwa zingine:

  • CursorBench 4.0, ambayo inasisitiza kazi za usimbaji za muda mrefu: Grok 4.7 amepata 46.3%, mbele ya GPT-5.6 Sol Max (41.7%) na Grok 4.6 High (40.4%), lakini nyuma ya Fable 5.1 Max (51.8%).
  • Terminal-Bench 4.0, kazi ya terminal ya saa nyingi: 38.0%, imepanda kwa kasi kutoka 20.3% kwa Grok 4.6 na mbele kidogo ya GPT-5.6 Sol Max (37.3%), ingawa Fable 5.1 Max inaongoza kwa 57.9%.
  • EEBench, alama ya uhandisi wa umeme: 64.0%, kuruka kubwa kutoka kwa Grok 4.6 ya 53.0% na ya juu zaidi ya mifano iliyoorodheshwa.
  • DeepSWE v1.1: 71.0% kwa juhudi kubwa, dhidi ya 65.2% kwa Grok 4.6 na 72.7% kwa GPT-5.6 Sol Max.
  • Briefcase ya AA v1.1, kazi ya ofisi ya saa nyingi: 1,657, kutoka 1,546, na funga nyuma ya Fable 5.1 Max saa 1,678.
  • Kigezo cha Wakala wa Kisheria wa Harvey: 19.6%, mbele ya Grok 4.6 (15.8%) na mbele zaidi ya GPT-5.6 Sol Max (2.5%) na Fable 5.1 Max (6.7%) kwenye kipimo hiki.
  • HealthBench Professional: 56.7%, kuboreshwa kwenye Grok 4.6's 48.5% lakini ikifuatiwa na GPT-5.6 Sol Max (60.5%) na Fable 5.1 Max (62.1%).

Kwenye GDPval, alama ya taaluma ya maarifa-kazi iliyopigwa na Elo, chati ya xAI inaweka Grok 4.7 katika hoja xhigh kwenye 1,695 - kutoka 1,605 kwa Grok 4.6, nyuma ya Fable 5.1 Max (1,735) na mbele ya GPT-6 Astra Max (1,542).

Bei Ndio Hadithi

Dai kali zaidi katika tangazo hilo ni la kiuchumi badala ya la kiufundi: xAI inaeleza Grok 4.7 kuwa haraka mara mbili kwa nusu ya bei ya miundo inayolingana, na jedwali la bei lililochapishwa linaunga mkono ulinganisho wa kichwa cha habari dhidi ya usanidi wa kiwango cha juu cha wapinzani wake wakuu wawili. Bei ya tokeni ya Grok 4.7 ya $2/$6 haijabadilishwa kutoka Grok 4.6, kumaanisha kuwa wanunuzi wanapata uboreshaji wa kizazi hadi kizazi bila ongezeko la bei.

Nafasi hiyo inapanua mkakati ambao xAI imefuata kwenye mstari wa Grok 4.x: mechi au karibia ubora wa mipaka huku ikipunguza viwango vya bei vya juu vya OpenAI na Anthropic, kisha usambaze kwa nguvu kupitia washirika ikijumuisha GitHub, Cursor na OpenRouter.

Cha Kutazama

Tahadhari ya kweli ni kwamba xAI ilichapisha chati ya ulinganishi yenyewe, na uthibitishaji huru kutoka kwa viunganishi vya ulinganishaji utachukua siku. Kwenye nambari ambazo xAI ilichagua kuangazia, Grok 4.7 ni hatua ya kweli ya kupanda kutoka Grok 4.6 - inayoonekana zaidi kwenye Terminal-Bench 4.0 na EEBench - lakini haifagii Fable 5.1 Max, ambayo inabakia kuongoza kwenye usimbaji na vigezo vya afya huku ikigharimu mara tano zaidi kwa tokeni ya pato.

Kwa wasanidi programu wanaofanya kazi kwa muda mrefu, wa saa nyingi, hesabu ya utendaji wa bei inaweza kuwa muhimu zaidi kuliko nafasi ghafi ya ubao wa wanaoongoza. Grok 4.7 inapatikana sasa kupitia API ya xAI na katika GitHub Copilot.

Kaa Mbele ya AI

Kwa utangazaji endelevu wa maendeleo muhimu zaidi ya tasnia ya AI, alamisho AI Buzz Wire na usikose hadithi muhimu.

Soma habari zaidi za AI