این شرکت در یک پست وبلاگی با عنوان "به اشتراک گذاری پیشرفت هوش مصنوعی در ریاضیات" که در روز سه شنبه، 6 اکتبر 2026 منتشر شد، در دومین افت بزرگ ریاضیات خود در همین چند ماه، گفت که OpenAI یافته هایی را در مورد 377 مسئله تحقیقاتی ریاضی منتشر کرده است.

نتایج شامل جبر، علوم کامپیوتر نظری و منطق ریاضی می‌شود و تنها چند هفته پس از ادعای OpenAI برای حل معادلات ناویر-استوکس، یکی از معروف‌ترین مسائل حل‌نشده جهان با جایزه 1 میلیون دلاری، به دست می‌آیند. ادعای قبلی ریاضیدانان را از هم جدا کرده بود. انتشار بسیار بزرگتر این هفته بحث را تشدید کرده است. برای خوانندگانی که [اخبار فوری هوش مصنوعی] (https://aibuzzwire.news) را دنبال می‌کنند، این قسمت به روشن‌ترین آزمایشی تبدیل شده است که نشان می‌دهد چگونه جامعه تحقیقاتی باید نتایج تولید شده توسط ماشین‌ها را که انسان‌ها نمی‌توانند به راحتی آن‌ها را تأیید کنند، مدیریت کنند.

آنچه OpenAI در واقع منتشر شد

به گزارش گاردین، OpenAI «بیش از 370 نتیجه ریاضی را در موضوعات مختلف مانند جبر، علوم کامپیوتر نظری و منطق ریاضی منتشر کرد». نیویورک تایمز شمارش را 377 مشکل اعلام کرد، در حالی که نیوساینتیست گزارش داد که انتشار شامل 722 اکتشاف ریاضی پس از جمع آوری نتایج کمکی است. شمارش‌های متفاوت منعکس‌کننده روش‌های مختلف گروه‌بندی لم‌ها، نتیجه‌ها و راه‌حل‌های کامل به «نتایج» گسسته است.

مقیاس همان چیزی است که ناظران را حیرت زده کرد. جایی که ادعای ماه گذشته Navier-Stokes شامل یک نتیجه واحد و دقیق بررسی شده بود، این نسخه به یکباره یافت شد - صدها یافته در چندین زیر زمینه که توسط پیشرفته‌ترین مدل‌های داخلی OpenAI ایجاد شده‌اند. این داستان در عرض یک روز مورد توجه واشنگتن پست، اکونومیست، وال استریت ژورنال و فورچون قرار گرفت و پست وبلاگ OpenAI با بیش از هزار رأی موافق در صدر اخبار هکر قرار گرفت.

موسسه مطالعات پیشرفته عقب نشینی می کند

موسسه مطالعات پیشرفته در پرینستون، نیوجرسی - خانه قدیمی چهره هایی مانند انیشتین و فون نویمان - گفت که آزمایش مدل های مرزی در برابر سخت ترین مشکلات باز این رشته را تایید نمی کند، به ویژه زمانی که کار پشت درهای بسته انجام می شود.

این سازمان در بیانیه‌ای اعلام کرد: «حالاً هوش مصنوعی می‌تواند استدلال‌های ریاضی را در موقعیت‌ها ارائه کند، بدون اینکه انسانی که آن را وادار کرده است بتواند استدلال‌ها را بفهمد، آنها را تأیید کند یا مسئولیت آنها را بپذیرد». ما معتقدیم که درک انسان از ریاضیات از اهمیت بالایی برخوردار است.

نگرانی این نیست که نتایج لزوما اشتباه باشد. این است که ریاضیات به عنوان یک رشته به تأیید بستگی دارد، و سیل ادعاهای تولید شده توسط ماشین که هیچ انسانی آن را بررسی نکرده است، با هنجارهای علمی ناخوشایند می نشیند.

پاسخ OpenAI: یک صندلی پشت میز

برای مقابله با این واکنش، OpenAI اعلام کرد که با مؤسسه مطالعات پیشرفته همکاری خواهد کرد تا به «ریاضی‌دانان صدایی در مورد نحوه حرکت ما به جلو» بدهد. گاردین خاطرنشان کرد که آنچه شرکت به آن متعهد نشده است، هرگونه تغییر در رویه اساسی است: OpenAI هیچ نشانه ای از توقف آزمایش مشکلات پیشرفته در مدل های داخلی اختصاصی ارائه نکرده است.

هیئت مشاوران مؤسسه همچنین از آزمایشگاه‌های هوش مصنوعی خواست تا به سیستم‌های مرزی خود «دسترسی عادلانه» بدهند. این گروه نوشت: «استفاده از مدل‌های داخلی اختصاصی توسط آزمایشگاه‌های هوش مصنوعی برای انجام تحقیقات ریاضی، ایجاد یک سیستم دو سطحی را به خطر می‌اندازد که در آن آزمایشگاه‌ها از بقیه حوزه پیشی می‌گیرند و به طور مؤثر جامعه ریاضی را از رشته خود بیگانه می‌کند».

"کار کسی را بردارید و آن را به اتمام برسانید"

ریاضیدانان نزدیک به مسائل تحت تأثیر یک موضوع ظریف تر را مطرح می کنند: اعتبار. تریستان باک مستر، ریاضیدان دانشگاه نیویورک که روی مسئله ناویر-استوکس کار می‌کرد، به نیویورک تایمز گفت که محققانی که مدل‌های هوش مصنوعی را پیشنهاد می‌کنند، ممکن است پیشرفت جزئی مدل‌ها را به پایان برسانند.

باک مستر گفت: «احتمالاً یکسری نتایج وجود دارد که در آن آنها کار یک نفر را می گیرند و سپس آن را تکمیل می کنند.

اگر دقیق باشد، این پویایی هر دو اسناد و ارزیابی را پیچیده می کند. نتیجه ای که به نظر می رسد یک پیشرفت ماشین مستقل باشد، در واقع ممکن است آخرین گام بر روی داربست ساخته شده توسط انسان باشد - داربستی که انسان هرگز حاضر به تحویل آن نشد.

برای تحقیقات هوش مصنوعی چه معنایی دارد

نسخه‌های ریاضیات در حال تبدیل شدن به ویترینی تکرارشونده برای قابلیت‌های آزمایشگاه مرزی، و آزمون استرس مکرر برای چگونگی جذب علم خروجی ماشین‌ها هستند. قاب‌بندی وال استریت ژورنال ضربه شلاقی را به تصویر کشید: هوش مصنوعی یک مسئله ریاضی را حل کرد و همه ترسیدند - اکنون صدها مشکل دیگر را شکسته است.

سه سوال اتفاق بعدی را شکل می دهد. اول، راستی‌آزمایی: ریاضیدانان مستقل به ماه‌ها زمان نیاز دارند تا حتی کسری از 377 نتیجه را بررسی کنند، و اگر خطا پیدا شود، اعتبار OpenAI را به شدت تحت تأثیر قرار می‌دهد. دوم، دسترسی: آیا آزمایشگاه‌ها قوی‌ترین مدل‌های خود را به‌روی محققان خارجی، آن‌طور که مؤسسه می‌خواهد، باز می‌کنند، یا حلقه را بسته نگه می‌دارند. سوم، تقدم: همانطور که نگرانی Buckmaster نشان می دهد، این زمینه ممکن است به هنجارهای جدیدی برای اعتبار دادن به شواهد مشترک انسان و هوش مصنوعی نیاز داشته باشد.

به گفته گاردین، OpenAI به درخواست‌ها برای اظهار نظر در مورد انتقادات پاسخ نداد. این که آیا همکاری با موسسه مطالعات پیشرفته هنجارهای قابل اجرا را ایجاد می کند - یا صرفاً عدم توافق را مستند می کند - احتمالاً تعیین می کند که آیا ریاضیات معیار اصلی پیشرفت هوش مصنوعی مرزی باقی می ماند یا اولین زمینه ای است که به طور رسمی از آن عقب نشینی می کند.

از هوش مصنوعی جلوتر بمانید اخبار هوش مصنوعی را در AI Buzz Wire بخوانید