قامت OpenAI بإصلاح ثلاثة عيوب تقول إنها تفسر أسبوعًا من شكاوى المستخدمين بأن GPT-6 Astra، أحدث طراز لها، أصبح أكثر غباءً منذ إطلاقه - وتقوم بإعادة تعيين حدود الاستخدام لمشتركي Codex كنوع من الاعتذار. جاء التحديث من رئيس منتج Codex Tibo Sottiaux، الذي قال إن الفريق عمل مع المستخدمين لتتبع الأخطاء، ثم شحن الإصلاحات وإعادة ضبط الاستخدام الكامل قبل منتصف الليل بالتوقيت المحلي، وفقًا لتحديث نُشر يوم السبت.

يغلق القبول امتدادًا تقريبيًا لما وصفته OpenAI بأنه النموذج الأكثر قدرة حتى الآن. منذ أن وصلت Astra إلى التوفر على نطاق واسع في أوائل سبتمبر، كان المطورون على X يقومون بتشغيل مطالبات متطابقة ضد Astra في يوم الإطلاق والإصدار الحالي، مع الحفاظ على كل الإعدادات كما هي، ونشر مقارنات جنبًا إلى جنب يبدو أنها تظهر نموذجًا ضعيفًا بهدوء. لمعرفة المزيد عن النماذج التي تقود هذا النقاش، راجع تغطيتنا أحدث تطورات الذكاء الاصطناعي.

العيوب الثلاثة، مسماة

وفقًا لسوتيو، كان السبب الأول هو المهارات - الملفات السريعة المكتوبة لنماذج سابقة والتي تم تشغيلها كثيرًا في ظل Astra، مما أدى في بعض الأحيان إلى منع النموذج من التحقق من عمله. أما الثاني فهو تجربة اختيارية لإدارة السياق يمكنها إنهاء النموذج مبكرًا أو الرد على الرسائل القديمة. وقالت الشركة إن OpenAI عطلت التجربة بعد أن تأثر ما يقرب من 4000 إلى 5000 مستخدم.

أما العيب الثالث فيتعلق بالبنية التحتية وليس النموذج نفسه: فقد تم تكوين بعض محركات الاستدلال بشكل غير صحيح مما أدى إلى تدهور جودة حركة المرور الخلفية التي يتم توجيهها من خلالها. قامت شركة OpenAI بإزالة تلك المحركات وأجرت عدة إصلاحات أصغر. كتب Sottiaux أن النموذج يتتبع الآن أحدث رسالة للمستخدم بشكل أكثر دقة - في إشارة إلى الشكاوى من أن Astra كانت تجيب على الأسئلة التي تجاوزها المستخدم بالفعل.

لقد انتقل المطورون بالفعل

الشكاوى بنيت خلال الأسبوع. عاد المطور برانجال باليوال، الذي أشاد بـ Astra قبل أيام، وقرأ الكود الذي كتبته له، ثم وصف النتيجة بأنها تراجع وليس تقدم. قام داكس رعد، الذي صمم أداة البرمجة Opencode، بنقل فريقه مرة أخرى إلى GPT-5.6 Sol الأقدم بعد أن تضاعف الإنفاق على Astra بسبب الجوانب السلبية التي رأى أنها لا تستحق المال. وصف أحد الملصقات في المنتدى Astra بأنها الآن على مستوى Sol في مهام متطابقة، مع نفس عمليات إعادة المحاولة.

لم يقبل الجميع تلك القراءة. جادل مستخدم باسم مستعار يكتب باسم Antikythera بأن النموذج كان دائمًا كسولًا ومولعًا بالنقاط، وأن المستخدمين توقفوا ببساطة عن الانبهار. يجسد هذا الخلاف مدى صعوبة تسوية المطالبات المتعلقة بجودة النموذج: مطالبات متطابقة، وأحكام مختلفة.

مشكلة في السعة في الخلفية

وصل صف الجودة بينما ألقت السعة بظلالها على عملية الطرح. خفضت OpenAI حدود استخدام Astra لمستخدمي ChatGPT بكثافة وفقًا لتقارير المستخدمين، وأوقفت مؤقتًا اشتراكات Pro الجديدة بقيمة 200 دولار - وهي خطوة أكدها Sottiaux في 10 سبتمبر، مشيرًا إلى الطلب. لا يزال النموذج يكلف 10 دولارات لكل مليون رمز إدخال و50 دولارًا لكل مليون رمز إخراج، وهو ما يعادل 2.5 ضعف ما فرضه Sol عند إطلاقه.

هناك أيضًا سابقة غير مريحة: هذه هي ثاني شركة OpenAI الرائدة خلال شهرين والتي توجه نفس الاتهام من المستخدمين الذين يدفعون. في شهر يوليو، قال المستخدمون إن طريقة التفكير العليا لدى سول أصبحت سطحية بين عشية وضحاها. ونفى سوتيو إضعافها عمدًا في ذلك الوقت، بينما أكد أن الشركة كانت تجرب جهودًا منطقية. إن الدورات المتكررة من عبارة "لقد أصبح النموذج أسوأ" تليها عبارة "وجدنا عيوبًا" أصبحت نمطًا يتعين على الشركة إدارته - فالشفافية تساعد، ولكن الاستقرار يساعد أيضًا.

نصيحة OpenAI الخاصة: استخدم عددًا أقل من حواجز الحماية

إلى جانب الإصلاحات، نشرت OpenAI إرشادات الترحيل من المهندس Eric Provencher والتي ترقى إلى مستوى توصية غير بديهية: النماذج الأكثر قدرة تحتاج إلى قدر أقل من التحكم. وتقول الإرشادات إن أوصاف المهارات الطويلة للغاية ومتطلبات القراءة الشاملة وقواعد الموافقة الصارمة يمكن أن تعيق طريق أسترا. يمكن للتعليمات التي تراكمت مع مرور الوقت أن تأكل السياق أو تتسبب في توقف النموذج عن العمل مبكرًا.

ويوصي بروفينشر بأن تقوم الفرق بمراجعة مهاراتها وملفات AGENTS.md ومطالبات المهام كلما قاموا بتبديل النماذج، وربط التعليمات بإحكام بمهام محددة، وتحديد وقت إنجاز المهمة بوضوح - لأنه حتى بدون قيود، قد تتوقف Astra في وقت أبكر من توقف GPT-5.6 Sol. يجب على الفرق التي أغلقت الأمور بعد أن أصبحت النماذج السابقة مارقة، أن تعيد النظر في تلك القواعد: يقول المنشور إن شركة Astra لديها حكم أفضل، لكنها يمكنها تفسير القيود القديمة بشكل حرفي بحيث تتوقف عندما تريد الاستمرار.

ماذا سيحدث بعد ذلك

تمنح إعادة ضبط الاستخدام لمشتركي Codex مساحة نظيفة لإعادة تقييم النموذج، وستراقب OpenAI نفس الاختبارات التي يجريها المستخدمون جنبًا إلى جنب. السؤال الأعمق هو الثقة: المطورون الذين يدفعون المال والذين شهدوا تدهورًا رئيسيًا في غضون أسبوع من الإطلاق لديهم الآن تفسير موثق وثلاثة عيوب محددة وإعادة تعيين - ولكن أيضًا سببًا جديدًا لقياس كل تحديث للنموذج مقابل اليوم الذي تم شحنه فيه.

ابق في صدارة الذكاء الاصطناعي

يتم تتبع عمليات إطلاق النماذج، وعمليات فحص العيوب بعد الوفاة، والأدوات التي تعيد تشكيل عمل البرامج، كل يوم.

اقرأ المزيد من أخبار الذكاء الاصطناعي →