أصدرت OpenAI GPT-6.1 Sol في 29 سبتمبر، وتوقفت عن العمل GPT-6 Sol بعد سبعة أيام فقط من ظهور هذا النموذج لأول مرة، وفقًا لشركة القياس المستقلة Artificial Analysis. تزامنت عملية المبادلة مع مؤتمر مطوري DevDay للشركة، حيث ذكرت CNET أنه يمكن للحاضرين البدء في استخدام GPT-6.1 Sol على الفور جنبًا إلى جنب مع وكلاء Dots الذين تم إطلاقهم حديثًا ومجموعة من تغييرات الاشتراك.
يعد استبدال الرائد لمدة سبعة أيام أمرًا غير معتاد حتى وفقًا للمعايير المتسارعة لعام 2026، وتشير المعايير إلى سبب تحرك OpenAI بسرعة. للحصول على تغطية مستمرة لعمليات إطلاق النماذج ومعارك المعايير وحرب التسعير التي ترتكز عليها، يتتبع AI Buzz Wire التطورات المهمة فور حدوثها.
قفزة ملحوظة في سبعة أيام
يشير التحليل الاصطناعي إلى أن GPT-6.1 Sol يكتسب 4 نقاط على مؤشر الذكاء الخاص بالشركة مقارنة بـ GPT-6 Sol، و5 نقاط فوق GPT-5.6 Sol، ليهبط بنقطة واحدة فقط تحت GPT-6 Astra، النموذج الأكثر قدرة في OpenAI. يمزج تقييم الشركة بين التفكير والعمل المعرفي والرياضيات والمهام الوكيلة في درجة مقارنة واحدة.
تظهر الدرجات الفرعية مكان تركيز المكاسب. تم تحسين GPT-6.1 Sol بمقدار 4 نقاط في AA-Briefcase v1.1 و5 نقاط فيGDPval-AA v2.1، وكلاهما يعمل على اختبار المعرفة الوكيلة. تشير قفزة 12 نقطة في Terminal-Bench 4.0 إلى أداء أفضل ماديًا في البيئات الطرفية الحقيقية، بينما ارتفع اختبار Humanity's Last Exam بمقدار 5 نقاط وارتفع الناتج المحلي الإجمالي 6.
يبرز رقم واحد لأي شخص يستخدم النماذج للبحث: ارتفعت الدقة في AA-Omniscience بمقدار 8 نقاط بينما انخفض معدل الهلوسة من 60 بالمائة إلى 54 بالمائة. يظل كلا الرقمين مرتفعين من حيث القيمة المطلقة، ولكن اتجاه السفر مهم بالنسبة لسير العمل حيث تكون الإجابة الخاطئة الواثقة أسوأ من عدم وجود إجابة.
نفس سعر الملصق، وأرخص من الناحية العملية
فيما يتعلق بالتسعير، يحتفظ GPT-6.1 Sol ببطاقة أسعار GPT-6 Sol بقيمة 2 دولار لكل مليون رمز إدخال و10 دولارات لكل مليون رمز مميز للمخرج، لكن خصم قراءة ذاكرة التخزين المؤقت يرتفع من 90 بالمائة إلى 95 بالمائة. ويشير التحليل الاصطناعي إلى أن السعر المختلط لـ GPT-6.1 Sol لأحمال عمل الوكلاء أقل قليلاً من سعر GPT-6 Sol، مما يوسع سلسلة من التخفيضات الفعالة في الأسعار التي بدأت عندما تم إطلاق GPT-6 Sol بخصم 50 بالمائة على GPT-5.6 Sol.
مسار التسعير هو القصة الحقيقية هنا. وفي غضون إصدارين، نجحت شركة OpenAI في خفض التكلفة الفعلية لخطها الحدودي من الطبقة المتوسطة إلى النصف تقريبًا مرتين، مع دفع الجودة إلى الأعلى في كل مرة.
التكلفة لكل مهمة: 0.72 دولارًا أمريكيًا مقابل 3.26 دولارًا أمريكيًا
التكلفة لكل مهمة هي حيث تصبح الفجوة مع GPT-6 Astra صارخة. بأقصى جهد، يربط التحليل الاصطناعي GPT-6.1 Sol بسعر 0.72 دولارًا أمريكيًا لكل مهمة مؤشر ذكاء، أي أقل من ربع سعر GPT-6 Astra البالغ 3.26 دولارًا أمريكيًا. مقارنة بسابقه، يبلغ التوفير 31 بالمائة (1.05 دولارًا أمريكيًا لـ GPT-6 Sol)، ومقابل GPT-5.6 Sol يصل إلى 64 بالمائة (1.99 دولارًا أمريكيًا).
وفقًا للشركة، فإن كل مستوى جهد في GPT-6.1 Sol يدفع حدود باريتو لفعالية التكلفة - مما يعني أنه بالنسبة لمستوى معين من الذكاء، لا يوجد خيار أرخص بين النماذج التي يتتبعها. صورة كفاءة الرمز المميز أكثر تباينًا: يستهلك GPT-6.1 Sol ما يقرب من 10 إلى 30 بالمائة من رموز الإخراج أكثر من GPT-6 Sol عبر مستويات الجهد، على الرغم من أن إعدادات الجهد المنخفض والمتوسط تظل مثالية Pareto لكفاءة الرمز المميز بمجرد أخذ الذكاء الأعلى في الاعتبار. في الترميز، حصل النموذج على 3 نقاط على GPT-6 Sol بأقصى جهد على مؤشر وكيل التشفير الخاص بالشركة.
سبب أهمية فترة التحول لمدة سبعة أيام
وتعزز القائمة الأوسع لـ DevDay نفس الصورة. لقد وضع تقرير CNET المؤتمر حول ثلاثة أشياء يمكن للمطورين استخدامها على الفور - GPT-6.1 Sol، ووكلاء Dots، وخطط الاشتراك المعاد صياغتها - بدلاً من معاينة البحث عن بعد. كانت الرسالة الموجهة للمطورين هي التوفر اليوم، وليس الإمكانية غدًا.
الإيقاعات الرئيسية هي إشارة قصيرة إلى أن القيد التنافسي قد تحول من دورات التدريب إلى تحسين ما بعد التدريب وخدمة البنية التحتية. تبدو الترقية على مستوى النقطة التي يتم شحنها خلال أسبوع أشبه بنقطة تفتيش محسنة وقائمة أسعار جديدة أكثر من كونها نموذجًا أساسيًا من الصفر، ويتصرف المنافسون بنفس الطريقة: أعلنت Google عن Gemini 4 Argon في 30 سبتمبر، وهو نموذج حدودي يصل في البداية إلى المدافعين السيبرانيين الموثوقين من خلال برنامج Fairwind الخاص بها بنفس معدل 2 دولار / 10 دولارات لكل مليون رمز مميز.
بالنسبة للمطورين، هناك ثلاث نقاط عملية تتبع الأرقام التي تم التحقق منها. أولاً، تستفيد أحمال عمل الوكلاء مع إعادة استخدام ذاكرة التخزين المؤقت الثقيلة على الفور من خصم ذاكرة التخزين المؤقت بنسبة 95 بالمائة. ثانيًا، يجب أن تضع الميزانيات نموذجًا لاستهلاك رمز الإنتاج الأعلى قبل الترحيل، نظرًا لأن سعر كل رمز مميز لم يتغير حتى مع تفكير النموذج لفترة أطول. ثالثًا، يظل Astra هو الحد الأقصى للمهام التي تستحق فيها النقطة الأخيرة من الذكاء تكلفة إضافية 4x - حالة GPT-6.1 Sol هي أنه بالنسبة لمعظم الأعمال، ليس الأمر كذلك.
التحذير يستحق التكرار: هذه الأرقام تأتي من مُقيّم مستقل واحد، مهما كانت منهجيته صارمة، ونتائج المؤشر تكافئ مزيجًا محددًا من أعباء العمل. يجب على الفرق ذات أعباء العمل الصعبة إعادة تشغيل تقييماتها الخاصة قبل إعادة توجيه حركة الإنتاج.
---
ابقَ في طليعة الذكاء الاصطناعياحصل على آخر الأخبار والتحليلات والإنجازات في مجال الذكاء الاصطناعي — كل ذلك في مكان واحد.
اقرأ المزيد من أخبار الذكاء الاصطناعي →