OpenAI پرده Astra، سیستم منتشرنشده ای را که آن را "مدل اصلی بعدی ما" می نامد، پس از اینکه یک نسخه داخلی ده پیشرفت قابل توجه در ریاضیات و علوم کامپیوتری نظری ایجاد کرد، کنار زد. این شرکت این اعلان را در یک پست تحقیقاتی که نتایج ریاضی را مستند می‌کند، قرار داد و باعث هیجان و بررسی دقیق محققانی شد که [اخبار فوری هوش مصنوعی] (https://aibuzzwire.news) را از نزدیک دنبال می‌کنند.

OpenAI نوشت: مشکلاتی که Astra به رفع آنها کمک کرد، «حداقل برای یک دهه، و در بیشتر موارد، پیشرفتی در نتایج اصلی خود نداشتند». نتایج شامل زمینه‌هایی از جمله هندسه با ابعاد بالا، نظریه کدگذاری، پیچیدگی مدار حسابی، نظریه گروه، پیچیدگی کوانتومی، رمزنگاری شبکه‌ای و ترکیب‌های افراطی می‌شود - قلمرویی که پیشرفت معمولاً در سال‌ها اندازه‌گیری می‌شود، نه تحقیقات واحد.

شواهد تایید شده، نه فقط پاسخ

آنچه خروجی Astra را از یک ربات چت که در ریاضی حدس می‌زند جدا می‌کند، تأیید است. OpenAI گفت که محققان انسانی از همان مدل برای تهیه استدلال به عنوان نسخه های خطی استفاده کردند و Astra سپس هر استدلال را به عنوان یک گواهی ناب رسمی کرد. Lean یک دستیار اثبات منبع باز است که می‌تواند استدلال‌های ریاضی را به صورت ماشینی بررسی کند، به این معنی که دیگر ریاضیدانان مجبور نیستند نتایج را بر اساس ایمان بگیرند - آنها می‌توانند به طور مستقل توسط نرم‌افزار در چند ثانیه تأیید شوند.

این تمایز مهم است. یک مدل زبانی می‌تواند دلیلی قابل قبول به‌نظر برسد که حاوی یک خطای نامحسوس و کشنده است. با ترجمه هر استدلال به Lean، OpenAI یک ادعای بازاریابی را به یک مصنوع قابل بررسی تبدیل کرد. به گفته BleepingComputer که جزئیات را گزارش کرده است، پیشرفت‌های خاص شامل اثبات وجود گروه‌های غیرصوفی، حل یک سوال باز اصلی در نظریه گروه است. رد حدس سفتی کونس. محدودیت‌های جدید برای بسته‌بندی کره‌ای با ابعاد بالا؛ و نتایج حل مشکلات متعددی است که در اصل توسط ریاضیدان پرکار پل اردوس مطرح شده بود.

OpenAI خاطرنشان کرد که تعداد کل توکن‌های مورد نیاز برای یافتن این راه‌حل‌ها با نرخ‌های API فعلی، تقریباً 2000 دلار هزینه خواهد داشت – یک نقطه داده قابل توجه در مورد ردپای محاسباتی اکتشافات ریاضی مدرن، و چیزی که تحقیقات سطح مرزی را به جای خود آزمایشگاه‌ها، در دسترس تیم‌های دانشگاهی با بودجه خوب قرار می‌دهد.

ریاضیدانان واکنش نشان می دهند

به گزارش The Decoder، توماس بلوم، ریاضیدان دانشگاه منچستر که سایت مرجع Erdős-problem erdosproblems.com را اداره می کند، نتایج را "خبر بزرگ" در X نامید. او آنها را مهمتر از مثالی برای حدس فاصله واحد منتشر شده در ماه می ارزیابی کرد. بلوم نوشت: "شاید بزرگتر از اثبات فاصله واحد نباشد، اما از نظر ساخت و ساز، این بزرگ است."

بلوم همچنین از چارچوبی که هوش مصنوعی جایگزین ریاضیدانان می شود عقب نشینی کرد و استدلال کرد که این ادعا زمانی که این سیستم از بیش از یک قرن تئوری استفاده می کند، توسط ریاضیدانان ساخته شده و بر روی هر چیزی که ریاضیدانان تا به حال نوشته اند آموزش دیده است، منطقی نیست.

نوام براون، محققی که پشت فناوری استدلال زمان آزمایشی که Astra به آن متکی است، بیشتر اندازه گیری شد. او با اشاره به هفت مسئله معروفی که موسسه ریاضیات Clay هر کدام 1 میلیون دلار برای آن ها ارائه می دهد، در X پست کرد: «متاسفانه، (هنوز) هیچ مشکلی برای جایزه هزاره وجود ندارد - تنها یکی از آنها از زمان اعلام جوایز در سال 2000 حل شده است.

همه تحت تأثیر قرار نگرفتند. گری مارکوس، منتقد هوش مصنوعی، این مدل را در یک پست Substack «شگفت‌انگیز – اما بسیار بیش از حد فروخته شد» نامید. تنش بین دستاوردهای فنی واقعی و چارچوب های تبلیغاتی احتمالاً نحوه دریافت Astra را مشخص می کند.

یک خانواده مدل جدید برای کارهای طولانی

اطلاعات به طور مستقل تأیید کرد که Astra یک خانواده مدل جدید است که برای بارهای کاری طولانی مدت ساخته شده است. OpenAI آن را به‌عنوان سیستمی توصیف می‌کند که به چندین عامل هوش مصنوعی اجازه می‌دهد در بخش‌های مختلف یک مشکل بزرگ‌تر با یکدیگر همکاری کنند - طراحی با هدف دقیقاً کارهایی که ساعت‌ها یا روزها طول می‌کشند تا ثانیه‌ها، مانند اثبات یک قضیه یا بازسازی یک پایگاه کد بزرگ.

BleepingComputer گزارش داد که OpenAI تصمیم نگرفته است که آیا این مدل با نام‌های GPT-5.7، GPT-6 یا با نام دیگری عرضه خواهد شد. The Decoder گزارش داد که سام آلتمن، مدیر عامل شرکت Astra را در واشنگتن دی سی به نمایش گذاشته است و نشان می دهد که این شرکت سیستم را به اندازه کافی بالغ می بیند که بتواند در مقابل سیاست گذاران قرار دهد.

مانع بررسی دولت

شاید مهم ترین جزئیات مربوط به مقررات باشد. به گفته The Decoder، Astra یکی از اولین مدل‌هایی است که فرآیند بررسی برنامه‌ریزی شده دولت ایالات متحده را طی می‌کند که قبل از انتشار عمومی نیاز به تایید رسمی دارد. این یک لایه عدم قطعیت سیاسی را به جدول زمانی عرضه می‌افزاید که مدل‌های پرچم‌دار قبلی هرگز با آن مواجه نبودند - و خطرات را برای چگونگی توصیف OpenAI از قابلیت‌های Astra افزایش می‌دهد.

اولین بازی همچنین در میان یک مسابقه سنگین وزن آزاد از راه می رسد. چند روز قبل، Thinking Machines Lab مدل وزن باز Inkling-Small خود را منتشر کرد و آزمایشگاه‌های چینی همچنان به پیشبرد سیستم‌های مرزی با وزن باز ادامه می‌دهند. Astra به شرط OpenAI هشدار می دهد که استدلال اختصاصی و در مقیاس بزرگ - که توسط ابزارهایی مانند Lean تأیید شده است - همچنان مسیر بزرگ ترین پیشرفت ها است.

در حال حاضر، Astra منتشر نشده باقی مانده است. اما اولین بازی ریاضی آن قبلاً این گفتگو را در مورد اینکه چه سیستم‌های هوش مصنوعی مرزی می‌توانند به علم ناب کمک کنند و اینکه مردم چقدر باید ادعاهای همراه با آنها را به دقت بررسی کنند، بازنگری کرده است.

از هوش مصنوعی جلوتر بمانید

آیا می خواهید با پیشرفت هایی مانند Astra و مسابقه مدل های مرزی گسترده تر همراه باشید؟ مرکز ما را برای [آخرین پیشرفت‌های هوش مصنوعی] (https://aibuzzwire.news) نشانک‌گذاری کنید.

بیشتر بخوانید اخبار هوش مصنوعی →