xAI نے Grok 4.7 کو جاری کیا ہے، جو کہ کوڈنگ اور علمی کام کے لیے کمپنی کا اب تک کا سب سے قابل ماڈل ہے، ہفتوں کی عوامی چھیڑ چھاڑ اور کم از کم ایک تاخیر کے بعد۔ اتوار کو کمپنی کی سائٹ پر اعلان کیا گیا، ماڈل اسی قیمت پر اترتا ہے اور اس کے پیشرو Grok 4.6 کے طور پر پیش کرتا ہے: $2 فی ملین ان پٹ ٹوکن اور $6 فی ملین آؤٹ پٹ ٹوکن، تقریباً نصف فہرست قیمت OpenAI کے GPT-5.6 Sol Max ($4/$20) اور اچھی طرح سے Anthropic's F.$50/50/$50 کے تحت۔
تازہ ترین AI خبروں اور تجزیہ کے لیے، AI Buzz Wire ملاحظہ کریں۔
ایک بڑا بیس ماڈل، طویل کاموں کے لیے تربیت یافتہ
xAI کے اعلان کے مطابق، Grok 4.7 Grok 4.6 کے مقابلے میں ایک نیا، بڑا بیس ماڈل استعمال کرتا ہے اور اسے کاموں کے ایک مشکل مرکب پر چلنے والی طویل کمک سیکھنے کے ساتھ تربیت دی گئی تھی، جس کا وزن ان مسائل کی طرف ہے جن کو مکمل ہونے میں کئی گھنٹے لگتے ہیں۔ کمپنی کا کہنا ہے کہ یہ ماڈل اپنے کام کی تصدیق کرنے اور طویل سیاق و سباق کا انتظام کرنے میں بہتر ہے، اور یہ کہ اسے گروک بوٹ استعمال کو مقامی طور پر سمجھنے، بات چیت کے کاموں اور عمومی علم کے کام کو بہتر بنانے کی تربیت دی گئی تھی۔
ریلیز ایک شور مچانے کے بعد ہے۔ TeslaNorth.com کے مطابق، ایلون مسک نے ستمبر کے اوائل میں سب سے پہلے کہا تھا کہ گروک 4.7 دس دنوں کے اندر اندر اترے گا، پھر ستمبر کے وسط میں تسلیم کیا کہ ماڈل کو مزید کچھ دنوں کی تطہیر کی ضرورت ہے۔ اب یہ شپنگ ہو رہا ہے، اور GitHub نے اسی دن تصدیق کی کہ Grok 4.7 GitHub Copilot میں دستیاب ہے۔
بینچ مارک تصویر: مضبوط، صاف نہیں
xAI کے ذریعہ شائع کردہ بینچ مارک ڈیٹا ایک ماڈل کو ظاہر کرتا ہے جو کئی طویل افق زمروں میں آگے بڑھتا ہے جبکہ دوسروں پر Anthropic کی سب سے مہنگی ترتیب سے پیچھے رہتا ہے:
- CursorBench 4.0، جو طویل عرصے تک چلنے والے کوڈنگ کاموں پر زور دیتا ہے: Grok 4.7 اسکور 46.3%، GPT-5.6 Sol Max (41.7%) سے آگے اور Grok 4.6 High (40.4%)، لیکن Fable 5.1 Max (51.8%) سے پیچھے۔
- ٹرمینل-بینچ 4.0، کثیر گھنٹے کا ٹرمینل کام: 38.0%، Grok 4.6 کے لیے 20.3% سے تیزی سے اوپر اور GPT-5.6 Sol Max (37.3%) سے بالکل آگے، حالانکہ Fable 5.1 Max 57.9% پر آگے ہے۔
- EEBench، ایک الیکٹریکل انجینئرنگ بینچ مارک: 64.0%، Grok 4.6 کے 53.0% سے ایک بڑی چھلانگ اور درج کردہ ماڈلز میں سب سے زیادہ۔
- DeepSWE v1.1: 71.0% زیادہ کوشش پر، بمقابلہ Grok 4.6 کے لیے 65.2% اور GPT-5.6 Sol Max کے لیے 72.7%۔
- AA بریف کیس v1.1، کئی گھنٹے دفتری کام: 1,657، 1,546 سے اوپر، اور Fable 5.1 Max کے پیچھے 1,678 پر۔
- ہاروی لیگل ایجنٹ کا بینچ مارک: اس پیمائش پر 19.6%، Grok 4.6 (15.8%) سے آگے اور GPT-5.6 Sol Max (2.5%) اور Fable 5.1 Max (6.7%) سے بہت آگے۔
- ہیلتھ بینچ پروفیشنل: 56.7%، Grok 4.6 کے 48.5% پر بہتری لیکن GPT-5.6 Sol Max (60.5%) اور Fable 5.1 Max (62.1%) سے پیچھے ہے۔
GDPval پر، Elo کے ذریعہ بنائے گئے ایک پیشہ ورانہ علمی کام کا بینچ مارک، xAI کا چارٹ Grok 4.7 کو اعلیٰ استدلال پر 1,695 پر رکھتا ہے - Grok 4.6 کے لیے 1,605 سے زیادہ، Fable 5.1 Max (1,735) سے پیچھے اور GPT-6 Astra Max (1,542) سے آگے۔
قیمت کہانی ہے۔
اعلان میں سب سے زیادہ جارحانہ دعوی تکنیکی کے بجائے معاشی ہے: xAI نے موازنہ ماڈلز کی نصف قیمت پر Grok 4.7 کو دوگنا تیز رفتاری سے بیان کیا ہے، اور شائع شدہ قیمتوں کا جدول اس کے دو اہم حریفوں کی اعلی درجے کی ترتیب کے مقابلے میں سرخی کے موازنہ کی حمایت کرتا ہے۔ Grok 4.7 کی $2/$6 ٹوکن کی قیمتوں میں Grok 4.6 سے کوئی تبدیلی نہیں کی گئی ہے، یعنی خریداروں کو قیمت میں اضافے کے بغیر نسل در نسل بہتری ملتی ہے۔
یہ پوزیشننگ ایک حکمت عملی کو بڑھاتی ہے جس نے xAI نے Grok 4.x لائن پر عمل کیا ہے: OpenAI اور Anthropic کے پریمیم قیمتوں کے درجات کو کم کرتے ہوئے میچ یا اپروچ فرنٹیئر کوالٹی، پھر شراکت داروں بشمول GitHub، Cursor، اور OpenRouter کے ذریعے جارحانہ انداز میں تقسیم کریں۔
کیا دیکھنا ہے۔
ایماندارانہ انتباہ یہ ہے کہ xAI نے موازنہ چارٹ خود شائع کیا، اور بینچ مارکنگ ایگریگیٹرز سے آزاد تصدیق میں دن لگیں گے۔ xAI نے جن نمبروں کو نمایاں کرنے کے لیے منتخب کیا ہے، Grok 4.7 Grok 4.6 سے ایک حقیقی قدم ہے — جو زیادہ تر ٹرمینل-بینچ 4.0 اور EEBench پر نظر آتا ہے — لیکن یہ Fable 5.1 Max کو سویپ نہیں کرتا، جو کوڈنگ اور ہیلتھ بینچ مارکس پر برتری برقرار رکھتا ہے جبکہ لاگت پانچ گنا زیادہ ہے۔
ڈویلپرز کے لیے طویل، کثیر گھنٹے ایجنٹی کام کا بوجھ، قیمت کی کارکردگی کا ریاضی خام لیڈر بورڈ پوزیشن سے زیادہ اہمیت رکھتا ہے۔ Grok 4.7 اب xAI کے API کے ذریعے اور GitHub Copilot میں دستیاب ہے۔
AI سے آگے رہیں
AI انڈسٹری کی سب سے اہم پیش رفت کی مسلسل کوریج کے لیے، AI Buzz Wire کو بک مارک کریں اور کبھی بھی بریکنگ اسٹوری سے محروم نہ ہوں۔
مزید AI خبریں پڑھیں