تنها یک روز پس از اینکه OpenAI قدرتمندترین مدل خود را بهطور کلی در دسترس قرار داد، این شرکت میگوید این سیستم اثبات کاملی از حدس و گمان پوشش دوگانه چرخه ارائه کرده است - یک مسئله باز مشهور در نظریه گراف که تقریباً نیم قرن در برابر ریاضیدانان مقاومت کرده است.
محقق OpenAI، اتان نایت، نتیجه را در 10 ژوئیه 2026 اعلام کرد و پست کرد که GPT-5.6 Sol Ultra "با استفاده از 64 عامل فرعی در کمتر از یک ساعت، مدرکی از حدس و گمان دو پوشش 50 ساله چرخه ای ارائه کرد." این ادعا به سرعت به صدر هکر نیوز صعود کرد و صدها نظر از ریاضیدانان و مهندسان را برانگیخت که در مورد اینکه آیا این اثبات وجود دارد یا خیر.
برای هر کسی که آخرین پیشرفتهای هوش مصنوعی را ردیابی میکند، نتیجه یک نمایش خیرهکننده از اینکه مدلهای مرزی به کجا میروند - و یادآوری این است که ادعاهای ریاضی آنها هنوز باید به روش قدیمی بررسی شود.
حدس پوشش دوگانه چرخه چیست؟
این حدس در شاخه ای از ریاضیات به نام نظریه گراف قرار دارد. به زبان ساده، یک سوال فریبنده ساده میپرسد: آیا میتوان لبههای هر گراف «بدون پل» - یکی بدون لبه که حذف آن از هم جدا میشود - همیشه توسط مجموعهای از چرخهها پوشانده شود تا هر یال دقیقاً دو بار ظاهر شود؟
این مسئله به طور مستقل توسط چندین ریاضیدان در طول سال ها مطرح شد، از جمله پل سیمور در سال 1979 و جورج سکرز در سال 1973، که ریشه های قبلی آن در کارهای W. T. Tutte و آلون Itai و Michael Rodeh بود. علیرغم بیان ساده اش، به یکی از شناخته شده ترین مسائل حل نشده در این زمینه تبدیل شد و نتایج جزئی فقط برای کلاس های خاصی از نمودارها شناخته شد.
بر اساس یادداشت اثباتی منتشر شده OpenAI، این استدلال مشکل را به نمودارهای مکعبی بدون حلقه کاهش می دهد، سپس به یک نتیجه کلاسیک - قضیه جریان هیچ جا صفر بر گروه F32 (معادل قضیه 8 جریان Tutte) - و یک مرحله جبری خطی کلیدی تکیه می کند که یک برچسب دو لبه را برای یک پوشش چرخه مورد نیاز تبدیل می کند. این نوشته تنها چند صفحه است و به طور مشخص، همانطور که یکی از مفسران هکر نیوز مشاهده کرد، از "هیچ ریاضیاتی در 30 سال گذشته توسعه نیافته است."
چگونه GPT-5.6 Sol Ultra به آن نزدیک شد
چیزی که این نتیجه را از پاسخ های معمولی چت بات متمایز می کند نحوه استقرار مدل است. GPT-5.6 Sol Ultra در حالت OpenAI "multiagent v2" اجرا شد و سیستمی متشکل از 64 عامل فرعی همکار را ایجاد کرد که استراتژی های اثبات مختلف را به طور موازی بررسی می کردند. OpenAI دستور کامل را در کنار اثبات منتشر کرد و نگاهی نادر به دستورالعمل های داده شده به سیستم ارائه کرد.
این درخواست به مدل دستور داد که «از چند عامل v2 به صورت تهاجمی و پویا استفاده کند»، «پرتفولیوی متنوعی از رویکردها» را حفظ کند، و عوامل متخاصم را برای بررسی هر گونه اثبات نامزدی برای مشکلات رایج - مانند مسیرهای بسته که به صورت چرخهها یا استدلال تصادفی تبدیل میشوند، مستقر کند. حتی به سیستم گفته بود "حداقل 8 ساعت را برای این کار وقت بگذارد قبل از اینکه حتی به بازگشت یا تسلیم شدن فکر کند"، اگرچه طبق گزارش ها، اجرای نهایی در کمتر از یک ساعت به پایان رسید.
در بخش "بیانیه استفاده از هوش مصنوعی" در یادداشت اثبات، OpenAI صریح است: "اثبات موجود در این یادداشت کاملاً به دلیل GPT 5.6 Sol Ultra و نوشتن با Codex (با GPT 5.6 Sol) است."
هنوز همه قانع نشده اند
جامعه ریاضی با ترکیبی از هیجان و احتیاط واکنش نشان داده است - و این شک و تردید در جای خوبی قرار دارد. از زمان انتشار، اثبات به طور رسمی در دستیار اثباتی مانند Lean تأیید نشده است، و همچنین از بررسی سنتی همتایان عبور نکرده است.
در هکر نیوز، چندین نظر دهنده خاطرنشان کردند که شواهد کوتاه و ظریف حدسهای معروف مستحق بررسی دقیق هستند. یکی از کاربران نوشت: "این یک مدرک بسیار کوتاه است که از هیچ ریاضیاتی که در 30 سال گذشته توسعه یافته است استفاده نمی کند." "که لزوماً باعث اشتباه نمی شود، اما در غیاب مکانیزه شدن در Lean یا بررسی همتایان مناسب، فکر می کنم ارسال این پست زود است."
برخی دیگر خاطرنشان کردند که کتابخانههای اثبات رسمی پیشرو نظریه گراف هنوز به اندازه کافی برای بررسی نتایج در سطح تحقیق از این دست رشد نکردهاند، به این معنی که تأیید ممکن است از متخصصان انسانی انجام شود که استدلال را خط به خط میخوانند. شرکت OpenAI خود اعلامیه را به عنوان بخشی از یک الگوی گستردهتر تعریف کرد: «محاسبات بیشتر در زمان آزمایش منجر به هوش بیشتر میشود»، این شرکت گفت که نشان میدهد رویکرد چند عاملی - نه این نتیجه واحد - داستان واقعی است که میخواهد بگوید.
چرا مهم است
حتی اگر اثبات Cycle Double Cover در نهایت نیاز به اصلاح داشته باشد، این قسمت نشانگر تغییر معنیداری در آنچه که مدلهای زبان بزرگ در ریاضیات محض میتوانند انجام دهند، است. سیستمهای هوش مصنوعی مرزی قبلاً نتایج تحقیقات جدیدی را در حوزههای تخصصی تولید کردهاند - از جمله دیگر ادعاهای اخیر در مورد مسائل حل شده در هندسه و ترکیبشناسی - اما حمله به یک حدس نامگذاری شده چند دههای با انبوهی هماهنگ از عوامل استدلالی، بهطور قابلتوجهی سطح را بالا میبرد.
برای محققین، غذای آماده دو برابر است. اول، دستور العمل چند عاملی - بسیاری از تلاشهای مستقل، گرده افشانی متقابل ایدهها و ممیزی مخالف - به نظر میرسد یک الگوی واقعاً مفید برای حل مشکلات سخت باشد. دوم، گلوگاه راستیآزمایی اکنون کاملاً متوجه انسانها شده است: این مدل میتواند مدارک نامزد را سریعتر از جامعه بتواند آنها را بررسی کند.
این تنش احتمالاً فاز بعدی ریاضیات به کمک هوش مصنوعی را مشخص می کند. همانطور که یکی از نظردهنده ها بیان کرد، اگر این اثبات وجود داشته باشد، "کسی در شرف ایجاد لیستی" از دیگر مشکلات طولانی مدت است تا نسل بعدی مدل ها را بیاورد.
در حال حاضر، ریاضیدانان یادداشت سه صفحهای را با دقت میخوانند – مداد در دست – در حالی که بقیه صنعت هوش مصنوعی به تماشای اینکه آیا تلاش یک ساعته GPT-5.6 به بخشی از رکورد دائمی ریاضی تبدیل میشود یا خیر.
از هوش مصنوعی جلوتر بمانید
برای اطلاعات بیشتر در مورد پیشرفتهای مدل مرزی و پوشش تحقیقاتی هوش مصنوعی، به [صفحه اصلی AI Buzz Wire] (https://aibuzzwire.news) مراجعه کنید.
اطلاعات بیشتر اخبار هوش مصنوعی →---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →



