تنها یک روز پس از اینکه OpenAI قدرتمندترین مدل خود را به‌طور کلی در دسترس قرار داد، این شرکت می‌گوید این سیستم اثبات کاملی از حدس و گمان پوشش دوگانه چرخه ارائه کرده است - یک مسئله باز مشهور در نظریه گراف که تقریباً نیم قرن در برابر ریاضیدانان مقاومت کرده است.

محقق OpenAI، اتان نایت، نتیجه را در 10 ژوئیه 2026 اعلام کرد و پست کرد که GPT-5.6 Sol Ultra "با استفاده از 64 عامل فرعی در کمتر از یک ساعت، مدرکی از حدس و گمان دو پوشش 50 ساله چرخه ای ارائه کرد." این ادعا به سرعت به صدر هکر نیوز صعود کرد و صدها نظر از ریاضیدانان و مهندسان را برانگیخت که در مورد اینکه آیا این اثبات وجود دارد یا خیر.

برای هر کسی که آخرین پیشرفت‌های هوش مصنوعی را ردیابی می‌کند، نتیجه یک نمایش خیره‌کننده از اینکه مدل‌های مرزی به کجا می‌روند - و یادآوری این است که ادعاهای ریاضی آنها هنوز باید به روش قدیمی بررسی شود.

حدس پوشش دوگانه چرخه چیست؟

این حدس در شاخه ای از ریاضیات به نام نظریه گراف قرار دارد. به زبان ساده، یک سوال فریبنده ساده می‌پرسد: آیا می‌توان لبه‌های هر گراف «بدون پل» - یکی بدون لبه که حذف آن از هم جدا می‌شود - همیشه توسط مجموعه‌ای از چرخه‌ها پوشانده شود تا هر یال دقیقاً دو بار ظاهر شود؟

این مسئله به طور مستقل توسط چندین ریاضیدان در طول سال ها مطرح شد، از جمله پل سیمور در سال 1979 و جورج سکرز در سال 1973، که ریشه های قبلی آن در کارهای W. T. Tutte و آلون Itai و Michael Rodeh بود. علیرغم بیان ساده اش، به یکی از شناخته شده ترین مسائل حل نشده در این زمینه تبدیل شد و نتایج جزئی فقط برای کلاس های خاصی از نمودارها شناخته شد.

بر اساس یادداشت اثباتی منتشر شده OpenAI، این استدلال مشکل را به نمودارهای مکعبی بدون حلقه کاهش می دهد، سپس به یک نتیجه کلاسیک - قضیه جریان هیچ جا صفر بر گروه F32 (معادل قضیه 8 جریان Tutte) - و یک مرحله جبری خطی کلیدی تکیه می کند که یک برچسب دو لبه را برای یک پوشش چرخه مورد نیاز تبدیل می کند. این نوشته تنها چند صفحه است و به طور مشخص، همانطور که یکی از مفسران هکر نیوز مشاهده کرد، از "هیچ ریاضیاتی در 30 سال گذشته توسعه نیافته است."

چگونه GPT-5.6 Sol Ultra به آن نزدیک شد

چیزی که این نتیجه را از پاسخ های معمولی چت بات متمایز می کند نحوه استقرار مدل است. GPT-5.6 Sol Ultra در حالت OpenAI "multiagent v2" اجرا شد و سیستمی متشکل از 64 عامل فرعی همکار را ایجاد کرد که استراتژی های اثبات مختلف را به طور موازی بررسی می کردند. OpenAI دستور کامل را در کنار اثبات منتشر کرد و نگاهی نادر به دستورالعمل های داده شده به سیستم ارائه کرد.

این درخواست به مدل دستور داد که «از چند عامل v2 به صورت تهاجمی و پویا استفاده کند»، «پرتفولیوی متنوعی از رویکردها» را حفظ کند، و عوامل متخاصم را برای بررسی هر گونه اثبات نامزدی برای مشکلات رایج - مانند مسیرهای بسته که به صورت چرخه‌ها یا استدلال تصادفی تبدیل می‌شوند، مستقر کند. حتی به سیستم گفته بود "حداقل 8 ساعت را برای این کار وقت بگذارد قبل از اینکه حتی به بازگشت یا تسلیم شدن فکر کند"، اگرچه طبق گزارش ها، اجرای نهایی در کمتر از یک ساعت به پایان رسید.

در بخش "بیانیه استفاده از هوش مصنوعی" در یادداشت اثبات، OpenAI صریح است: "اثبات موجود در این یادداشت کاملاً به دلیل GPT 5.6 Sol Ultra و نوشتن با Codex (با GPT 5.6 Sol) است."

هنوز همه قانع نشده اند

جامعه ریاضی با ترکیبی از هیجان و احتیاط واکنش نشان داده است - و این شک و تردید در جای خوبی قرار دارد. از زمان انتشار، اثبات به طور رسمی در دستیار اثباتی مانند Lean تأیید نشده است، و همچنین از بررسی سنتی همتایان عبور نکرده است.

در هکر نیوز، چندین نظر دهنده خاطرنشان کردند که شواهد کوتاه و ظریف حدس‌های معروف مستحق بررسی دقیق هستند. یکی از کاربران نوشت: "این یک مدرک بسیار کوتاه است که از هیچ ریاضیاتی که در 30 سال گذشته توسعه یافته است استفاده نمی کند." "که لزوماً باعث اشتباه نمی شود، اما در غیاب مکانیزه شدن در Lean یا بررسی همتایان مناسب، فکر می کنم ارسال این پست زود است."

برخی دیگر خاطرنشان کردند که کتابخانه‌های اثبات رسمی پیشرو نظریه گراف هنوز به اندازه کافی برای بررسی نتایج در سطح تحقیق از این دست رشد نکرده‌اند، به این معنی که تأیید ممکن است از متخصصان انسانی انجام شود که استدلال را خط به خط می‌خوانند. شرکت OpenAI خود اعلامیه را به عنوان بخشی از یک الگوی گسترده‌تر تعریف کرد: «محاسبات بیشتر در زمان آزمایش منجر به هوش بیشتر می‌شود»، این شرکت گفت که نشان می‌دهد رویکرد چند عاملی - نه این نتیجه واحد - داستان واقعی است که می‌خواهد بگوید.

چرا مهم است

حتی اگر اثبات Cycle Double Cover در نهایت نیاز به اصلاح داشته باشد، این قسمت نشانگر تغییر معنی‌داری در آنچه که مدل‌های زبان بزرگ در ریاضیات محض می‌توانند انجام دهند، است. سیستم‌های هوش مصنوعی مرزی قبلاً نتایج تحقیقات جدیدی را در حوزه‌های تخصصی تولید کرده‌اند - از جمله دیگر ادعاهای اخیر در مورد مسائل حل شده در هندسه و ترکیب‌شناسی - اما حمله به یک حدس نام‌گذاری شده چند دهه‌ای با انبوهی هماهنگ از عوامل استدلالی، به‌طور قابل‌توجهی سطح را بالا می‌برد.

برای محققین، غذای آماده دو برابر است. اول، دستور العمل چند عاملی - بسیاری از تلاش‌های مستقل، گرده افشانی متقابل ایده‌ها و ممیزی مخالف - به نظر می‌رسد یک الگوی واقعاً مفید برای حل مشکلات سخت باشد. دوم، گلوگاه راستی‌آزمایی اکنون کاملاً متوجه انسان‌ها شده است: این مدل می‌تواند مدارک نامزد را سریع‌تر از جامعه بتواند آنها را بررسی کند.

این تنش احتمالاً فاز بعدی ریاضیات به کمک هوش مصنوعی را مشخص می کند. همانطور که یکی از نظردهنده ها بیان کرد، اگر این اثبات وجود داشته باشد، "کسی در شرف ایجاد لیستی" از دیگر مشکلات طولانی مدت است تا نسل بعدی مدل ها را بیاورد.

در حال حاضر، ریاضی‌دانان یادداشت سه صفحه‌ای را با دقت می‌خوانند – مداد در دست – در حالی که بقیه صنعت هوش مصنوعی به تماشای اینکه آیا تلاش یک ساعته GPT-5.6 به بخشی از رکورد دائمی ریاضی تبدیل می‌شود یا خیر.

از هوش مصنوعی جلوتر بمانید

برای اطلاعات بیشتر در مورد پیشرفت‌های مدل مرزی و پوشش تحقیقاتی هوش مصنوعی، به [صفحه اصلی AI Buzz Wire] (https://aibuzzwire.news) مراجعه کنید.

اطلاعات بیشتر اخبار هوش مصنوعی →

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →