xAI Grok 4.6 را منتشر کرده است، آخرین نسخه از مدل زبان بزرگ مرزی خود، با امتیاز 61 در شاخص هوش آنالیز مصنوعی مطابق با GPT-5.6 Sol OpenAI. این مدل امروز راه اندازی شد و بلافاصله در Cursor و Grok Build با دسترسی API و ادغام شریک از طریق OpenRouter، Vercel و Cloudflare در دسترس است.

برای اطلاع از آخرین اخبار و تحلیل‌های هوش مصنوعی، به [AI Buzz Wire] (https://aibuzzwire.news) مراجعه کنید.

هوش مرزی با کسری از هزینه

بر اساس تجزیه و تحلیل مصنوعی، یک پلتفرم معیار مستقل، Grok 4.6 نسبت به سلف خود Grok 4.5 در شاخص هوش پنج امتیاز کسب می کند و xAI را در کنار OpenAI به سطح مرزی باز می گرداند. این مدل درست پشت کلود اپوس 5 (63) و کلود فابل 5 (62) از Anthropic و جلوتر از Kimi K3 قرار دارد.

چیزی که Grok 4.6 را به ویژه قابل توجه می کند قیمت آن است. قیمت سرفصل بدون تغییر نسبت به Grok 4.5 با 2 دلار به ازای هر میلیون توکن ورودی و 6 دلار در هر میلیون توکن خروجی باقی مانده است. این آن را بیش از 60٪ کمتر از Claude Opus 5 (5 دلار / 25 دلار) و GPT-5.6 Sol (5 دلار / 30 دلار) قرار می دهد. هزینه اندازه گیری شده برای هر کار 0.84 دلار است، که آن را در مرز هوش در مقابل هزینه پارتو قرار می دهد.

ثابت نگه داشتن قیمت در طول یک نسل در مرز غیرمعمول است، جایی که دستاوردهای اطلاعاتی معمولاً با افزایش قیمت همراه بوده است. Grok 4.6 افزایش پنج امتیازی شاخص هوش را با قیمت بدون تغییر ارائه می دهد.

ساخته شده برای عوامل طولانی مدت

Grok 4.6 بر اساس Grok 4.5 با آنچه xAI به عنوان تمرکز خاص بر عوامل طولانی مدت و کارهای تعاملی و بصری جاه طلبانه تر توصیف می کند، ساخته شده است. این شرکت می‌گوید که این مدل در بسیاری از مراحل با وظایف پیچیده باقی می‌ماند، خواه تحقیق در مورد یک موضوع، تجزیه و تحلیل اطلاعات، کار در یک پایگاه کد یا تبدیل یک ایده به یک برنامه کاربردی صیقلی‌شده.

معیارهای عاملی داستان قانع کننده ای را بیان می کنند. در GDPval-AA v2، معیاری پیشرو برای کار دانش عامل در دنیای واقعی، Grok 4.6 به Elo 1753 دست می یابد که تنها پس از Claude Opus 5 و از نظر آماری با Claude Fable 5 و Qwen3.8 Max برابری می کند. امتیاز 50.7% را در معیار بانکداری تاو برای خدمات چند نوبتی به مشتریان کسب کرده و آن را در کنار Qwen3.8 Max در دو رتبه برتر قرار می دهد.

در CursorBench نسخه 3.2، Grok 4.6 امتیاز 69.9% را کسب کرده است، بالاتر از GPT-5.6 Sol (67.2%) و Grok 4.5 (66.7%). 65.9% در DeepSWE v1.1 و 61.3% در FrontierCode v1.1 Extended پست می کند.

راندمان چرخش قابل توجه

یکی از یافته‌های برجسته از تجزیه و تحلیل مصنوعی، نمایه کارایی Grok 4.6 در AA-Briefcase است، که یک معیار خصوصی برای وظایف کاری دانش عاملی افق طولانی است. این مدل با Elo 1577 معرفی شد و آن را در ردیف Fable 5 قرار داد.

اعداد بازده قابل توجه است. Grok 4.6 وظایف را در تقریباً 53 چرخش و 0.5 میلیارد توکن ورودی حل می کند، در مقایسه با تقریباً 103 چرخش و 2.0 میلیارد توکن ورودی برای Claude Opus 5 max. از آنجایی که کار عاملی افق طولانی به سرعت زمینه را انباشته می کند، مدلی که در نیمی از نوبت ها و یک چهارم توکن های ورودی به یک پاسخ قابل مقایسه می رسد، دارای مزیت هزینه ای فراتر از قیمت گذاری هر توکن است.

آموزش و ایمنی

Grok 4.6 نسبت به Grok 4.5 دوره آموزشی تکمیلی طولانی‌تری را با داده‌های مدل‌سازی شده برای استدلال و مفاهیم فنی پیشرفته، داده‌های مهندسی با کیفیت بالا، و بهینه‌ساز بهبودیافته و دستور العمل آموزشی پشت سر گذاشت. xAI از Grok 4.5 برای بازسازی مسیرهای SFT در تلاش‌های استدلالی، مهارهای عامل و حوزه‌هایی از جمله STEM، مهندسی نرم‌افزار و کار دانش استفاده کرد.

این مدل دارای یک پنجره زمینه 500000 توکن است که نسبت به Grok 4.5 تغییری نکرده است. xAI گزارش می‌دهد که Grok 4.6 تحت گسترده‌ترین مجموعه آزمایش‌های قبل از استقرار برای قابلیت‌ها و کالیبراسیون حفاظتی، همراه با آزمایش‌های گسترده پس از استقرار و شخص ثالث قرار گرفته است.

در دسترس بودن و قیمت

Grok 4.6 امروز در Cursor و Grok Build در دسترس است. xAI برای هفته اول استفاده مضاعف را در هر دو پلتفرم ارائه می دهد. قیمت گذاری از 2 دلار به ازای هر میلیون توکن ورودی و 6 دلار در هر میلیون توکن خروجی شروع می شود، با یک نوع سریع با دو برابر قیمت موجود است. بازدیدهای کش به 0.50 دلار در هر میلیون توکن تخفیف داده می شود.

این نسخه به سرعت برای xAI ادامه می‌دهد و Grok 4.6 کمی بیش از یک ماه پس از Grok 4.5 عرضه می‌شود. این مدل xAI را به عنوان یک رقیب جدی در رقابت مرزی، به ویژه برای توسعه دهندگانی که عملکرد عامل و کارایی هزینه را در اولویت قرار می دهند، قرار می دهد.

از هوش مصنوعی جلوتر بمانید

برای پوشش مداوم مهم‌ترین پیشرفت‌های صنعت هوش مصنوعی، [AI Buzz Wire] (https://aibuzzwire.news) را نشانک‌گذاری کنید و هرگز یک داستان مهم را از دست ندهید.

اخبار هوش مصنوعی را بیشتر بخوانید