این شرکت در یک پست وبلاگی با عنوان "به اشتراک گذاری پیشرفت هوش مصنوعی در ریاضیات" که در روز سه شنبه، 6 اکتبر 2026 منتشر شد، در دومین افت بزرگ ریاضیات خود در همین چند ماه، گفت که OpenAI یافته هایی را در مورد 377 مسئله تحقیقاتی ریاضی منتشر کرده است.
نتایج شامل جبر، علوم کامپیوتر نظری و منطق ریاضی میشود و تنها چند هفته پس از ادعای OpenAI برای حل معادلات ناویر-استوکس، یکی از معروفترین مسائل حلنشده جهان با جایزه 1 میلیون دلاری، به دست میآیند. ادعای قبلی ریاضیدانان را از هم جدا کرده بود. انتشار بسیار بزرگتر این هفته بحث را تشدید کرده است. برای خوانندگانی که [اخبار فوری هوش مصنوعی] (https://aibuzzwire.news) را دنبال میکنند، این قسمت به روشنترین آزمایشی تبدیل شده است که نشان میدهد چگونه جامعه تحقیقاتی باید نتایج تولید شده توسط ماشینها را که انسانها نمیتوانند به راحتی آنها را تأیید کنند، مدیریت کنند.
آنچه OpenAI در واقع منتشر شد
به گزارش گاردین، OpenAI «بیش از 370 نتیجه ریاضی را در موضوعات مختلف مانند جبر، علوم کامپیوتر نظری و منطق ریاضی منتشر کرد». نیویورک تایمز شمارش را 377 مشکل اعلام کرد، در حالی که نیوساینتیست گزارش داد که انتشار شامل 722 اکتشاف ریاضی پس از جمع آوری نتایج کمکی است. شمارشهای متفاوت منعکسکننده روشهای مختلف گروهبندی لمها، نتیجهها و راهحلهای کامل به «نتایج» گسسته است.
مقیاس همان چیزی است که ناظران را حیرت زده کرد. جایی که ادعای ماه گذشته Navier-Stokes شامل یک نتیجه واحد و دقیق بررسی شده بود، این نسخه به یکباره یافت شد - صدها یافته در چندین زیر زمینه که توسط پیشرفتهترین مدلهای داخلی OpenAI ایجاد شدهاند. این داستان در عرض یک روز مورد توجه واشنگتن پست، اکونومیست، وال استریت ژورنال و فورچون قرار گرفت و پست وبلاگ OpenAI با بیش از هزار رأی موافق در صدر اخبار هکر قرار گرفت.
موسسه مطالعات پیشرفته عقب نشینی می کند
موسسه مطالعات پیشرفته در پرینستون، نیوجرسی - خانه قدیمی چهره هایی مانند انیشتین و فون نویمان - گفت که آزمایش مدل های مرزی در برابر سخت ترین مشکلات باز این رشته را تایید نمی کند، به ویژه زمانی که کار پشت درهای بسته انجام می شود.
این سازمان در بیانیهای اعلام کرد: «حالاً هوش مصنوعی میتواند استدلالهای ریاضی را در موقعیتها ارائه کند، بدون اینکه انسانی که آن را وادار کرده است بتواند استدلالها را بفهمد، آنها را تأیید کند یا مسئولیت آنها را بپذیرد». ما معتقدیم که درک انسان از ریاضیات از اهمیت بالایی برخوردار است.
نگرانی این نیست که نتایج لزوما اشتباه باشد. این است که ریاضیات به عنوان یک رشته به تأیید بستگی دارد، و سیل ادعاهای تولید شده توسط ماشین که هیچ انسانی آن را بررسی نکرده است، با هنجارهای علمی ناخوشایند می نشیند.
پاسخ OpenAI: یک صندلی پشت میز
برای مقابله با این واکنش، OpenAI اعلام کرد که با مؤسسه مطالعات پیشرفته همکاری خواهد کرد تا به «ریاضیدانان صدایی در مورد نحوه حرکت ما به جلو» بدهد. گاردین خاطرنشان کرد که آنچه شرکت به آن متعهد نشده است، هرگونه تغییر در رویه اساسی است: OpenAI هیچ نشانه ای از توقف آزمایش مشکلات پیشرفته در مدل های داخلی اختصاصی ارائه نکرده است.
هیئت مشاوران مؤسسه همچنین از آزمایشگاههای هوش مصنوعی خواست تا به سیستمهای مرزی خود «دسترسی عادلانه» بدهند. این گروه نوشت: «استفاده از مدلهای داخلی اختصاصی توسط آزمایشگاههای هوش مصنوعی برای انجام تحقیقات ریاضی، ایجاد یک سیستم دو سطحی را به خطر میاندازد که در آن آزمایشگاهها از بقیه حوزه پیشی میگیرند و به طور مؤثر جامعه ریاضی را از رشته خود بیگانه میکند».
"کار کسی را بردارید و آن را به اتمام برسانید"
ریاضیدانان نزدیک به مسائل تحت تأثیر یک موضوع ظریف تر را مطرح می کنند: اعتبار. تریستان باک مستر، ریاضیدان دانشگاه نیویورک که روی مسئله ناویر-استوکس کار میکرد، به نیویورک تایمز گفت که محققانی که مدلهای هوش مصنوعی را پیشنهاد میکنند، ممکن است پیشرفت جزئی مدلها را به پایان برسانند.
باک مستر گفت: «احتمالاً یکسری نتایج وجود دارد که در آن آنها کار یک نفر را می گیرند و سپس آن را تکمیل می کنند.
اگر دقیق باشد، این پویایی هر دو اسناد و ارزیابی را پیچیده می کند. نتیجه ای که به نظر می رسد یک پیشرفت ماشین مستقل باشد، در واقع ممکن است آخرین گام بر روی داربست ساخته شده توسط انسان باشد - داربستی که انسان هرگز حاضر به تحویل آن نشد.
برای تحقیقات هوش مصنوعی چه معنایی دارد
نسخههای ریاضیات در حال تبدیل شدن به ویترینی تکرارشونده برای قابلیتهای آزمایشگاه مرزی، و آزمون استرس مکرر برای چگونگی جذب علم خروجی ماشینها هستند. قاببندی وال استریت ژورنال ضربه شلاقی را به تصویر کشید: هوش مصنوعی یک مسئله ریاضی را حل کرد و همه ترسیدند - اکنون صدها مشکل دیگر را شکسته است.
سه سوال اتفاق بعدی را شکل می دهد. اول، راستیآزمایی: ریاضیدانان مستقل به ماهها زمان نیاز دارند تا حتی کسری از 377 نتیجه را بررسی کنند، و اگر خطا پیدا شود، اعتبار OpenAI را به شدت تحت تأثیر قرار میدهد. دوم، دسترسی: آیا آزمایشگاهها قویترین مدلهای خود را بهروی محققان خارجی، آنطور که مؤسسه میخواهد، باز میکنند، یا حلقه را بسته نگه میدارند. سوم، تقدم: همانطور که نگرانی Buckmaster نشان می دهد، این زمینه ممکن است به هنجارهای جدیدی برای اعتبار دادن به شواهد مشترک انسان و هوش مصنوعی نیاز داشته باشد.
به گفته گاردین، OpenAI به درخواستها برای اظهار نظر در مورد انتقادات پاسخ نداد. این که آیا همکاری با موسسه مطالعات پیشرفته هنجارهای قابل اجرا را ایجاد می کند - یا صرفاً عدم توافق را مستند می کند - احتمالاً تعیین می کند که آیا ریاضیات معیار اصلی پیشرفت هوش مصنوعی مرزی باقی می ماند یا اولین زمینه ای است که به طور رسمی از آن عقب نشینی می کند.
از هوش مصنوعی جلوتر بمانید اخبار هوش مصنوعی را در AI Buzz Wire بخوانید