بر اساس گزارش شرکت مستقل تحلیل مصنوعی، OpenAI GPT-6.1 Sol را در 29 سپتامبر منتشر کرد و GPT-6 Sol را تنها هفت روز پس از معرفی آن مدل بازنشسته کرد. این مبادله همزمان با کنفرانس توسعه دهندگان DevDay این شرکت بود، جایی که CNET گزارش داد که شرکت کنندگان می توانند بلافاصله در کنار عوامل Dots تازه راه اندازی شده و مجموعه ای از تغییرات اشتراک، استفاده از GPT-6.1 Sol را شروع کنند.
جایگزینی هفت روزه پرچمدار به پرچمدار حتی با استانداردهای شتاب یافته سال 2026 غیرمعمول است و معیارها نشان می دهند که چرا OpenAI سریع حرکت کرد. [AI Buzz Wire] (https://aibuzzwire.news) برای پوشش مداوم عرضههای مدل، مبارزات معیار، و جنگ قیمتگذاری در زیر آنها، پیشرفتهای مهم را در حین وقوع ردیابی میکند.
یک پرش قابل اندازه گیری در هفت روز
تجزیه و تحلیل مصنوعی گزارش می دهد که GPT-6.1 Sol در شاخص هوش شرکت نسبت به GPT-6 Sol، 4 امتیاز و نسبت به GPT-5.6 Sol، 5 امتیاز کسب می کند و تنها 1 امتیاز کمتر از GPT-6 Astra، تواناترین مدل OpenAI، فرود می آید. ارزیابی شرکت، استدلال، کار دانش، ریاضی و وظایف عاملی را در یک امتیاز مقایسه ای واحد ترکیب می کند.
نمرات فرعی نشان می دهد که دستاوردها در کجا متمرکز می شوند. GPT-6.1 Sol 4 امتیاز در AA-Briefcase v1.1 و 5 امتیاز در GDPval-AA v2.1 بهبود داد که هر دوی آنها دانش عامل را آزمایش می کنند. جهش 12 امتیازی در Terminal-Bench 4.0 به عملکرد مادی بهتر در محیطهای پایانه واقعی اشاره کرد، در حالی که آخرین امتحان Humanity 5 امتیاز و GDP.pdf 6 افزایش یافت.
یک عدد برای هر کسی که از مدل ها برای تحقیق استفاده می کند برجسته است: دقت در AA-Omniscience 8 امتیاز افزایش یافت در حالی که میزان توهم از 60 درصد به 54 درصد کاهش یافت. هر دو رقم به صورت مطلق بالا باقی میمانند، اما جهت سفر برای گردشهای کاری مهم است که در آن پاسخ اشتباه مطمئن بدتر از عدم پاسخ است.
همان قیمت برچسب، در عمل ارزان تر است
در قیمت گذاری، GPT-6.1 Sol کارت نرخ GPT-6 Sol را 2 دلار به ازای هر میلیون توکن ورودی و 10 دلار در هر میلیون توکن خروجی نگه می دارد، اما تخفیف خواندن حافظه پنهان از 90 درصد به 95 درصد افزایش می یابد. تجزیه و تحلیل مصنوعی اشاره می کند که قیمت ترکیبی GPT-6.1 Sol برای بارهای کاری عاملی، بنابراین اندکی کمتر از GPT-6 Sol است، که باعث گسترش رگه ای از کاهش قیمت موثر که زمانی آغاز شد که GPT-6 Sol با 50 درصد تخفیف به GPT-5.6 Sol راه اندازی شد.
مسیر قیمت گذاری داستان واقعی اینجاست. در مدت دو نسخه، OpenAI تقریباً دو بار هزینه موثر خط مرزی سطح متوسط خود را به نصف کاهش داده است، در حالی که هر بار کیفیت را به سمت بالا میبرد.
هزینه هر کار: 0.72 دلار در مقابل 3.26 دلار
هزینه هر کار جایی است که شکاف با GPT-6 Astra شدیدتر می شود. در حداکثر تلاش، تجزیه و تحلیل مصنوعی GPT-6.1 Sol را به 0.72 دلار به ازای هر کار شاخص هوش، کمتر از یک چهارم قیمت 3.26 دلاری GPT-6 Astra، تعیین می کند. در مقایسه با نسل قبلی خود، پس انداز 31 درصد (1.05 دلار برای GPT-6 Sol) و در مقابل GPT-5.6 Sol به 64 درصد (1.99 دلار) می رسد.
به گفته این شرکت، هر سطح تلاشی از GPT-6.1 Sol مرز پارتو را با کارآیی بالا کنار میزند - به این معنی که برای سطح معینی از هوش، هیچ گزینه ارزانتری در بین مدلهایی که ردیابی میکند وجود ندارد. تصویر بازده توکن ترکیبیتر است: GPT-6.1 Sol تقریباً 10 تا 30 درصد توکنهای خروجی بیشتری را نسبت به GPT-6 Sol در سطوح تلاش مصرف میکند، اگرچه تنظیمات تلاش کم و متوسط آن پس از در نظر گرفتن هوش بالاتر، 3 امتیاز Sol را در بیش از تلاشهای بیش از GPTx به دست آورد.
چرا چرخش هفت روزه مهم است
تخته سنگ گسترده تر DevDay همین تصویر را تقویت می کند. گزارش CNET کنفرانس را حول سه چیز که توسعهدهندگان میتوانستند فوراً استفاده کنند - GPT-6.1 Sol، عوامل Dots و برنامههای اشتراک مجدد - به جای یک پیشنمایش تحقیق از راه دور، تنظیم کرد. پیام به توسعه دهندگان این بود که امروز در دسترس است، نه امکان فردا.
پرچمدار این سیگنال کوتاه را نشان میدهد که محدودیت رقابتی از دورههای آموزشی به اصلاح پس از آموزش و زیرساخت ارائه خدمات تغییر کرده است. ارتقاء سطح نقطه ای که در عرض یک هفته ارسال می شود، بیشتر شبیه یک ایست بازرسی بهینه شده و یک برگه قیمت جدید است تا یک مدل پایه اولیه، و رقبا نیز همین رفتار را دارند: گوگل Gemini 4 Argon را در 30 سپتامبر معرفی کرد، یک مدل مرزی که در ابتدا از طریق برنامه Fairwind خود با نرخ 10 دلار به ازای هر 2 میلیون دلار به مدافعان سایبری قابل اعتماد می رسد.
برای توسعه دهندگان، سه نکته کاربردی از اعداد تأیید شده دنبال می شود. اول، بارهای کاری نمایندگی با استفاده مجدد از حافظه پنهان، بلافاصله از تخفیف 95 درصدی حافظه پنهان بهره مند می شوند. دوم، بودجهها باید مصرف توکن خروجی بالاتر را قبل از مهاجرت مدلسازی کنند، زیرا قیمت هر توکن بدون تغییر است، حتی زمانی که مدل بیشتر فکر میکند. سوم، Astra سقف وظایفی است که آخرین نقطه هوش ارزش 4 برابر هزینه را دارد – مورد GPT-6.1 Sol این است که برای بیشتر کارها چنین نیست.
هشداری که ارزش تکرار دارد: این ارقام از یک ارزیاب مستقل، هر چند متدولوژی دقیق آن، بدست میآیند، و امتیازات شاخص به ترکیبهای حجم کاری خاص پاداش میدهد. تیم هایی با حجم کاری سخت باید ارزیابی های خود را قبل از تغییر مسیر ترافیک تولید انجام دهند.
---
از هوش مصنوعی جلوتر بمانیدآخرین اخبار، تحلیل ها و پیشرفت های هوش مصنوعی را دریافت کنید - همه در یک مکان.
بیشتر بخوانید اخبار هوش مصنوعی →