بعد يوم واحد فقط من إتاحة OpenAI لأقوى نموذج لها بشكل عام، تقول الشركة إن النظام أنتج دليلاً كاملاً على حدسية الغلاف المزدوج للدورة - وهي مشكلة مفتوحة مشهورة في نظرية الرسم البياني والتي قاومت علماء الرياضيات لمدة نصف قرن تقريبًا.
أعلن الباحث في OpenAI إيثان نايت النتيجة في 10 يوليو 2026، حيث نشر أن GPT-5.6 Sol Ultra "أنتج دليلاً على تخمين Cycle Double Cover Conjecture البالغ من العمر 50 عامًا باستخدام 64 وكيلًا فرعيًا في أقل من ساعة واحدة." وسرعان ما صعد هذا الادعاء إلى أعلى موقع Hacker News، حيث اجتذب مئات التعليقات من علماء الرياضيات والمهندسين الذين ناقشوا ما إذا كان الدليل صحيحًا أم لا.
بالنسبة لأي شخص يتتبع أحدث تطورات الذكاء الاصطناعي، فإن النتيجة هي عرض مذهل للاتجاه الذي تتجه إليه النماذج الرائدة - وتذكير بأن ادعاءاتهم الرياضية لا تزال بحاجة إلى التحقق من صحتها بالطريقة القديمة.
ما هو تخمين الدورة ذات الغطاء المزدوج؟
يقع هذا التخمين في فرع من الرياضيات يسمى نظرية الرسم البياني. بعبارات واضحة، فإنه يطرح سؤالاً بسيطًا بشكل خادع: هل يمكن دائمًا تغطية حواف أي رسم بياني "بدون جسور" - أي رسم بدون حافة يمكن أن تؤدي إزالته إلى تقسيمه - دائمًا إلى تغطيتها بمجموعة من الدورات بحيث تظهر كل حافة مرتين بالضبط؟
تم طرح هذه المشكلة بشكل مستقل من قبل العديد من علماء الرياضيات على مر السنين، بما في ذلك بول سيمور في عام 1979 وجورج سيكيريس في عام 1973، مع جذور سابقة في أعمال دبليو تي توت وألون إيتاي ومايكل روده. على الرغم من بيانها البسيط، إلا أنها أصبحت واحدة من أشهر المسائل التي لم يتم حلها في هذا المجال، وكانت النتائج الجزئية معروفة فقط لفئات خاصة من الرسوم البيانية.
وفقًا لمذكرة الإثبات التي نشرها OpenAI، فإن الحجة تقلل المشكلة إلى رسوم بيانية مكعبة غير قابلة للحلقة، ثم تعتمد على نتيجة كلاسيكية - نظرية التدفق الصفري في أي مكان على المجموعة F32 (أي ما يعادل نظرية توت 8-تدفق) - وخطوة جبرية خطية رئيسية تحول علامات الحافة إلى البنية اللازمة لغطاء مزدوج للدورة. يبلغ طول المقالة بضع صفحات فقط، ولا تستخدم على وجه الخصوص "أي رياضيات تم تطويرها خلال الثلاثين عامًا الماضية"، كما لاحظ أحد المعلقين في Hacker News.
كيف تم التعامل مع GPT-5.6 Sol Ultra
ما يميز هذه النتيجة عن إجابات chatbot العادية هو كيفية نشر النموذج. تم تشغيل GPT-5.6 Sol Ultra في وضع OpenAI "متعدد الوكلاء v2"، مما أدى إلى إنشاء نظام يضم ما يصل إلى 64 وكيلًا فرعيًا متعاونًا يستكشف استراتيجيات إثبات مختلفة بالتوازي. أصدرت OpenAI الموجه الكامل إلى جانب الدليل، مما يوفر نظرة نادرة على التعليمات المقدمة للنظام.
وجهت المطالبة النموذج إلى "استخدام الإصدار الثاني متعدد العوامل بقوة وديناميكية،" للحفاظ على "مجموعة متنوعة من الأساليب"، ونشر وكلاء متعارضين لتدقيق أي دليل مرشح للمزالق الشائعة - مثل المسارات المغلقة التي تتنكر في هيئة دورات أو تفكير دائري عرضي. حتى أنه طلب من النظام "قضاء ما لا يقل عن 8 ساعات في هذا الأمر قبل حتى التفكير في العودة أو الاستسلام"، على الرغم من أن الجولة النهائية قد اكتملت في أقل من ساعة.
في قسم "بيان استخدام الذكاء الاصطناعي" بمذكرة الإثبات، كان OpenAI واضحًا: "الإثبات في هذه المذكرة يرجع بالكامل إلى GPT 5.6 Sol Ultra والكتابة باستخدام Codex (مع GPT 5.6 Sol)."
لم يقتنع الجميع بعد
لقد كان رد فعل المجتمع الرياضي مزيجًا من الإثارة والحذر، وهذه الشكوك في محلها. اعتبارًا من تاريخ النشر، لم يتم التحقق من الدليل رسميًا في مساعد إثبات مثل Lean، ولم يجتاز مراجعة النظراء التقليدية.
في موقع Hacker News، أشار العديد من المعلقين إلى أن البراهين القصيرة والدقيقة للتخمينات الشهيرة تستحق التدقيق الدقيق بشكل خاص. وكتب أحد المستخدمين: "إنه دليل قصير جدًا لا يستخدم أي رياضيات تم تطويرها خلال الثلاثين عامًا الماضية". "وهذا لا يجعل الأمر خاطئًا بالضرورة، ولكن في ظل غياب الميكنة في مراجعة Lean أو مراجعة النظراء المناسبة، أعتقد أنه من السابق لأوانه نشر هذا."
وأشار آخرون إلى أن مكتبات الإثبات الرسمية الرائدة في نظرية الرسم البياني ليست ناضجة بعد بما يكفي للتحقق من النتائج على مستوى البحث من هذا النوع، مما يعني أن التحقق قد يحتاج إلى أن يأتي من خبراء بشريين يقرأون الحجة سطرًا تلو الآخر. وقد صاغت شركة OpenAI نفسها الإعلان كجزء من نمط أوسع: "المزيد من الحوسبة في وقت الاختبار يؤدي إلى قدر أكبر من الذكاء"، مما يشير إلى أن النهج متعدد الوكلاء - وليس هذه النتيجة الفردية - هو القصة الحقيقية التي تريد سردها.
لماذا يهم
حتى لو كان دليل الغلاف المزدوج يحتاج إلى تصحيح في نهاية المطاف، فإن هذه الحلقة تشير إلى تحول ملموس في ما يمكن أن تفعله نماذج اللغة الكبيرة في الرياضيات البحتة. أنتجت أنظمة Frontier AI سابقًا نتائج بحثية جديدة في مجالات متخصصة - بما في ذلك ادعاءات حديثة أخرى حول مشاكل تم حلها في الهندسة والتوافقيات - ولكن مهاجمة تخمين محدد عمره عقود من الزمن باستخدام سرب منسق من العوامل المنطقية يرفع المستوى إلى حد كبير.
بالنسبة للباحثين، فإن الوجبات الجاهزة ذات شقين. أولاً، يبدو أن الوصفة المتعددة الوكلاء - العديد من المحاولات المستقلة، والتلقيح المتبادل للأفكار، والتدقيق التنافسي - هي نموذج مفيد حقاً لحل المشكلات الصعبة. ثانياً، أصبح عنق الزجاجة في مجال التحقق الآن على عاتق البشر بشكل مباشر: فالنموذج قادر على توليد الأدلة المرشحة بشكل أسرع من قدرة المجتمع على التحقق منها.
من المرجح أن يحدد هذا التوتر المرحلة التالية من الرياضيات بمساعدة الذكاء الاصطناعي. وكما قال أحد المعلقين، إذا كان هذا الدليل صحيحًا، فإن "شخصًا ما على وشك بدء قائمة" من المشكلات الأخرى طويلة الأمد لطرحها على الجيل التالي من النماذج.
في الوقت الحالي، سيقرأ علماء الرياضيات الملاحظة المكونة من ثلاث صفحات بعناية - قلم رصاص في أيديهم - بينما يراقب بقية العاملين في صناعة الذكاء الاصطناعي لمعرفة ما إذا كان جهد GPT-5.6 الذي دام ساعة سيصبح جزءًا من السجل الرياضي الدائم.
ابق في صدارة الذكاء الاصطناعي
لمعرفة المزيد عن اختراقات النماذج الرائدة وتغطية أبحاث الذكاء الاصطناعي، تفضل بزيارة الصفحة الرئيسية لـ AI Buzz Wire.
اقرأ المزيد من أخبار الذكاء الاصطناعي →



