بر اساس گزارش شرکت مستقل تحلیل مصنوعی، OpenAI GPT-6.1 Sol را در 29 سپتامبر منتشر کرد و GPT-6 Sol را تنها هفت روز پس از معرفی آن مدل بازنشسته کرد. این مبادله همزمان با کنفرانس توسعه دهندگان DevDay این شرکت بود، جایی که CNET گزارش داد که شرکت کنندگان می توانند بلافاصله در کنار عوامل Dots تازه راه اندازی شده و مجموعه ای از تغییرات اشتراک، استفاده از GPT-6.1 Sol را شروع کنند.

جایگزینی هفت روزه پرچمدار به پرچمدار حتی با استانداردهای شتاب یافته سال 2026 غیرمعمول است و معیارها نشان می دهند که چرا OpenAI سریع حرکت کرد. [AI Buzz Wire] (https://aibuzzwire.news) برای پوشش مداوم عرضه‌های مدل، مبارزات معیار، و جنگ قیمت‌گذاری در زیر آن‌ها، پیشرفت‌های مهم را در حین وقوع ردیابی می‌کند.

یک پرش قابل اندازه گیری در هفت روز

تجزیه و تحلیل مصنوعی گزارش می دهد که GPT-6.1 Sol در شاخص هوش شرکت نسبت به GPT-6 Sol، 4 امتیاز و نسبت به GPT-5.6 Sol، 5 امتیاز کسب می کند و تنها 1 امتیاز کمتر از GPT-6 Astra، تواناترین مدل OpenAI، فرود می آید. ارزیابی شرکت، استدلال، کار دانش، ریاضی و وظایف عاملی را در یک امتیاز مقایسه ای واحد ترکیب می کند.

نمرات فرعی نشان می دهد که دستاوردها در کجا متمرکز می شوند. GPT-6.1 Sol 4 امتیاز در AA-Briefcase v1.1 و 5 امتیاز در GDPval-AA v2.1 بهبود داد که هر دوی آنها دانش عامل را آزمایش می کنند. جهش 12 امتیازی در Terminal-Bench 4.0 به عملکرد مادی بهتر در محیط‌های پایانه واقعی اشاره کرد، در حالی که آخرین امتحان Humanity 5 امتیاز و GDP.pdf 6 افزایش یافت.

یک عدد برای هر کسی که از مدل ها برای تحقیق استفاده می کند برجسته است: دقت در AA-Omniscience 8 امتیاز افزایش یافت در حالی که میزان توهم از 60 درصد به 54 درصد کاهش یافت. هر دو رقم به صورت مطلق بالا باقی می‌مانند، اما جهت سفر برای گردش‌های کاری مهم است که در آن پاسخ اشتباه مطمئن بدتر از عدم پاسخ است.

همان قیمت برچسب، در عمل ارزان تر است

در قیمت گذاری، GPT-6.1 Sol کارت نرخ GPT-6 Sol را 2 دلار به ازای هر میلیون توکن ورودی و 10 دلار در هر میلیون توکن خروجی نگه می دارد، اما تخفیف خواندن حافظه پنهان از 90 درصد به 95 درصد افزایش می یابد. تجزیه و تحلیل مصنوعی اشاره می کند که قیمت ترکیبی GPT-6.1 Sol برای بارهای کاری عاملی، بنابراین اندکی کمتر از GPT-6 Sol است، که باعث گسترش رگه ای از کاهش قیمت موثر که زمانی آغاز شد که GPT-6 Sol با 50 درصد تخفیف به GPT-5.6 Sol راه اندازی شد.

مسیر قیمت گذاری داستان واقعی اینجاست. در مدت دو نسخه، OpenAI تقریباً دو بار هزینه موثر خط مرزی سطح متوسط ​​خود را به نصف کاهش داده است، در حالی که هر بار کیفیت را به سمت بالا می‌برد.

هزینه هر کار: 0.72 دلار در مقابل 3.26 دلار

هزینه هر کار جایی است که شکاف با GPT-6 Astra شدیدتر می شود. در حداکثر تلاش، تجزیه و تحلیل مصنوعی GPT-6.1 Sol را به 0.72 دلار به ازای هر کار شاخص هوش، کمتر از یک چهارم قیمت 3.26 دلاری GPT-6 Astra، تعیین می کند. در مقایسه با نسل قبلی خود، پس انداز 31 درصد (1.05 دلار برای GPT-6 Sol) و در مقابل GPT-5.6 Sol به 64 درصد (1.99 دلار) می رسد.

به گفته این شرکت، هر سطح تلاشی از GPT-6.1 Sol مرز پارتو را با کارآیی بالا کنار می‌زند - به این معنی که برای سطح معینی از هوش، هیچ گزینه ارزان‌تری در بین مدل‌هایی که ردیابی می‌کند وجود ندارد. تصویر بازده توکن ترکیبی‌تر است: GPT-6.1 Sol تقریباً 10 تا 30 درصد توکن‌های خروجی بیشتری را نسبت به GPT-6 Sol در سطوح تلاش مصرف می‌کند، اگرچه تنظیمات تلاش کم و متوسط ​​آن پس از در نظر گرفتن هوش بالاتر، 3 امتیاز Sol را در بیش از تلاش‌های بیش از GPTx به دست آورد.

چرا چرخش هفت روزه مهم است

تخته سنگ گسترده تر DevDay همین تصویر را تقویت می کند. گزارش CNET کنفرانس را حول سه چیز که توسعه‌دهندگان می‌توانستند فوراً استفاده کنند - GPT-6.1 Sol، عوامل Dots و برنامه‌های اشتراک مجدد - به جای یک پیش‌نمایش تحقیق از راه دور، تنظیم کرد. پیام به توسعه دهندگان این بود که امروز در دسترس است، نه امکان فردا.

پرچم‌دار این سیگنال کوتاه را نشان می‌دهد که محدودیت رقابتی از دوره‌های آموزشی به اصلاح پس از آموزش و زیرساخت ارائه خدمات تغییر کرده است. ارتقاء سطح نقطه ای که در عرض یک هفته ارسال می شود، بیشتر شبیه یک ایست بازرسی بهینه شده و یک برگه قیمت جدید است تا یک مدل پایه اولیه، و رقبا نیز همین رفتار را دارند: گوگل Gemini 4 Argon را در 30 سپتامبر معرفی کرد، یک مدل مرزی که در ابتدا از طریق برنامه Fairwind خود با نرخ 10 دلار به ازای هر 2 میلیون دلار به مدافعان سایبری قابل اعتماد می رسد.

برای توسعه دهندگان، سه نکته کاربردی از اعداد تأیید شده دنبال می شود. اول، بارهای کاری نمایندگی با استفاده مجدد از حافظه پنهان، بلافاصله از تخفیف 95 درصدی حافظه پنهان بهره مند می شوند. دوم، بودجه‌ها باید مصرف توکن خروجی بالاتر را قبل از مهاجرت مدل‌سازی کنند، زیرا قیمت هر توکن بدون تغییر است، حتی زمانی که مدل بیشتر فکر می‌کند. سوم، Astra سقف وظایفی است که آخرین نقطه هوش ارزش 4 برابر هزینه را دارد – مورد GPT-6.1 Sol این است که برای بیشتر کارها چنین نیست.

هشداری که ارزش تکرار دارد: این ارقام از یک ارزیاب مستقل، هر چند متدولوژی دقیق آن، بدست می‌آیند، و امتیازات شاخص به ترکیب‌های حجم کاری خاص پاداش می‌دهد. تیم هایی با حجم کاری سخت باید ارزیابی های خود را قبل از تغییر مسیر ترافیک تولید انجام دهند.

---

از هوش مصنوعی جلوتر بمانید

آخرین اخبار، تحلیل ها و پیشرفت های هوش مصنوعی را دریافت کنید - همه در یک مکان.

بیشتر بخوانید اخبار هوش مصنوعی →