xAI ने Grok 4.7 जारी केले आहे, कोडिंग आणि ज्ञान कार्यासाठी कंपनीचे आजपर्यंतचे सर्वात सक्षम मॉडेल, सार्वजनिक छेडछाड आणि किमान एक विलंबानंतर. रविवारी कंपनीच्या साइटवर घोषित केलेले, मॉडेल त्याच्या पूर्ववर्ती Grok 4.6 प्रमाणेच किंमत आणि सर्व्हिंग स्पीडवर उतरते: $2 प्रति दशलक्ष इनपुट टोकन आणि $6 प्रति दशलक्ष आउटपुट टोकन, जे OpenAI च्या GPT-5.6 Sol Max ($4/$20) च्या सूची किमतीच्या अंदाजे निम्मे आणि Anthropic's F$50/50 ($50/$50) च्या खाली आहे.

नवीनतम ब्रेकिंग AI बातम्या आणि विश्लेषणासाठी, AI Buzz Wire ला भेट द्या.

एक मोठे बेस मॉडेल, दीर्घ कार्यांसाठी प्रशिक्षित

xAI च्या घोषणेनुसार, Grok 4.7 हे Grok 4.6 च्या तुलनेत एक नवीन, मोठ्या बेस मॉडेलचा वापर करते आणि कठीण कार्यांच्या मिश्रणावर दीर्घ मजबुतीकरण शिक्षणासह प्रशिक्षित होते, ज्या समस्या पूर्ण होण्यासाठी अनेक तास लागतात. कंपनीचे म्हणणे आहे की मॉडेल स्वतःचे काम सत्यापित करणे आणि दीर्घ संदर्भ व्यवस्थापित करणे अधिक चांगले आहे आणि ते Grok Bot हार्नेस, संभाषणात्मक कार्ये आणि सामान्य ज्ञान कार्य सुधारण्यासाठी स्थानिकरित्या समजून घेण्यास प्रशिक्षित होते.

रिलीझ एक गोंगाट करणारा रन-अप खालील. एलोन मस्कने सप्टेंबरच्या सुरुवातीला सांगितले की Grok 4.7 दहा दिवसांत उतरेल, नंतर सप्टेंबरच्या मध्यात कबूल केले की मॉडेलला आणखी काही दिवस परिष्करण आवश्यक आहे, टेस्लानॉर्थ डॉट कॉमच्या मते. ते आता शिपिंग होत आहे आणि GitHub ने त्याच दिवशी पुष्टी केली की Grok 4.7 GitHub Copilot मध्ये उपलब्ध आहे.

बेंचमार्क चित्र: मजबूत, स्वीपिंग नाही

xAI द्वारे प्रकाशित बेंचमार्क डेटा एक मॉडेल दर्शवितो जे अनेक लांब-क्षितिज श्रेणींमध्ये आघाडीवर आहे आणि इतरांवरील अँथ्रोपिकच्या सर्वात महाग कॉन्फिगरेशनमध्ये मागे राहिले आहे:

  • कर्सरबेंच 4.0, जे दीर्घकाळ चालणाऱ्या कोडिंग कार्यांवर जोर देते: Grok 4.7 स्कोअर 46.3%, GPT-5.6 Sol Max (41.7%) च्या पुढे आणि Grok 4.6 High (40.4%), परंतु Fable 5.1 Max (51.8%) च्या मागे.
  • टर्मिनल-बेंच 4.0, बहु-तास टर्मिनल कार्य: 38.0%, Grok 4.6 साठी 20.3% वरून झपाट्याने वाढ आणि GPT-5.6 Sol Max (37.3%) च्या अगदी पुढे, जरी Fable 5.1 Max 57.9% वर आघाडीवर आहे.
  • EEBench, एक विद्युत अभियांत्रिकी बेंचमार्क: 64.0%, Grok 4.6 च्या 53.0% वरून मोठी उडी आणि सूचीबद्ध मॉडेल्सपैकी सर्वोच्च.
  • DeepSWE v1.1: 71.0% उच्च प्रयत्नात, Grok 4.6 साठी 65.2% आणि GPT-5.6 Sol Max साठी 72.7%.
  • AA ब्रीफकेस v1.1, बहु-तास कार्यालयीन काम: 1,657, 1,546 वरून, आणि Fable 5.1 Max च्या मागे 1,678 वर बंद.
  • हार्वे लीगल एजंट बेंचमार्क: 19.6%, Grok 4.6 (15.8%) च्या पुढे आणि GPT-5.6 Sol Max (2.5%) आणि Fable 5.1 Max (6.7%) च्या खूप पुढे.
  • हेल्थबेंच प्रोफेशनल: 56.7%, Grok 4.6 च्या 48.5% वर सुधारणा करत आहे परंतु GPT-5.6 Sol Max (60.5%) आणि Fable 5.1 Max (62.1%) मागे आहे.

GDPval वर, Elo द्वारे स्कोअर केलेला व्यावसायिक ज्ञान-कार्य बेंचमार्क, xAI चा चार्ट Grok 4.7 ला x उच्च तर्क 1,695 वर ठेवतो - Grok 4.6 साठी 1,605 वरून, Fable 5.1 Max (1,735) च्या मागे आणि GPT-6 Astra Max (1,542) च्या पुढे.

किंमत ही कथा आहे

घोषणेतील सर्वात आक्रमक दावा तांत्रिक ऐवजी आर्थिक आहे: xAI तुलनात्मक मॉडेल्सच्या निम्म्या किमतीत Grok 4.7 चे दुप्पट वेगवान वर्णन करते आणि प्रकाशित किंमत सारणी त्याच्या दोन प्रमुख प्रतिस्पर्ध्यांच्या शीर्ष-स्तरीय कॉन्फिगरेशनच्या विरूद्ध शीर्षक तुलनाचे समर्थन करते. Grok 4.7 ची $2/$6 टोकन किंमत Grok 4.6 पासून अपरिवर्तित आहे, याचा अर्थ खरेदीदारांना किंमत वाढविल्याशिवाय पिढी-दर-पिढी सुधारणा मिळते.

ते पोझिशनिंग xAI ने Grok 4.x लाईनवर अवलंबलेल्या धोरणाचा विस्तार करते: OpenAI आणि Anthropic च्या प्रीमियम किमतीच्या टियर्स कमी करताना जुळणी करा किंवा फ्रंटियर गुणवत्तेशी संपर्क साधा, नंतर GitHub, Cursor आणि OpenRouter सह भागीदारांद्वारे आक्रमकपणे वितरित करा.

काय पहावे

प्रामाणिक चेतावणी अशी आहे की xAI ने तुलना चार्ट स्वतः प्रकाशित केला आहे आणि बेंचमार्किंग एग्रीगेटर्सकडून स्वतंत्र पडताळणीला काही दिवस लागतील. xAI ने हायलाइट करण्यासाठी निवडलेल्या आकड्यांवर, Grok 4.7 हे Grok 4.6 वरून एक अस्सल पायरी आहे — सर्वात दृश्यमानपणे टर्मिनल-बेंच 4.0 आणि EEBench वर — परंतु ते फेबल 5.1 मॅक्स स्वीप करत नाही, जे कोडिंग आणि हेल्थ बेंचमार्कवर आघाडी टिकवून ठेवते आणि प्रति पाच पट जास्त खर्च करते.

प्रदीर्घ, बहु-तास एजंटिक वर्कलोड चालवणाऱ्या डेव्हलपरसाठी, किंमत-कार्यक्षमतेचे गणित कच्च्या लीडरबोर्ड स्थितीपेक्षा जास्त महत्त्वाचे असू शकते. Grok 4.7 आता xAI च्या API द्वारे आणि GitHub Copilot मध्ये उपलब्ध आहे.

AI च्या पुढे रहा

AI उद्योगातील सर्वात महत्त्वाच्या घडामोडींच्या सतत कव्हरेजसाठी, बुकमार्क करा AI Buzz Wire आणि कधीही ब्रेकिंग स्टोरी चुकवू नका.

अधिक AI बातम्या वाचा