OpenAI نوشت: مشکلاتی که Astra به رفع آنها کمک کرد، «حداقل برای یک دهه، و در بیشتر موارد، پیشرفتی در نتایج اصلی خود نداشتند». نتایج شامل زمینههایی از جمله هندسه با ابعاد بالا، نظریه کدگذاری، پیچیدگی مدار حسابی، نظریه گروه، پیچیدگی کوانتومی، رمزنگاری شبکهای و ترکیبهای افراطی میشود - قلمرویی که پیشرفت معمولاً در سالها اندازهگیری میشود، نه تحقیقات واحد.
شواهد تایید شده، نه فقط پاسخ
آنچه خروجی Astra را از یک ربات چت که در ریاضی حدس میزند جدا میکند، تأیید است. OpenAI گفت که محققان انسانی از همان مدل برای تهیه استدلال به عنوان نسخه های خطی استفاده کردند و Astra سپس هر استدلال را به عنوان یک گواهی ناب رسمی کرد. Lean یک دستیار اثبات منبع باز است که میتواند استدلالهای ریاضی را به صورت ماشینی بررسی کند، به این معنی که دیگر ریاضیدانان مجبور نیستند نتایج را بر اساس ایمان بگیرند - آنها میتوانند به طور مستقل توسط نرمافزار در چند ثانیه تأیید شوند.
این تمایز مهم است. یک مدل زبانی میتواند دلیلی قابل قبول بهنظر برسد که حاوی یک خطای نامحسوس و کشنده است. با ترجمه هر استدلال به Lean، OpenAI یک ادعای بازاریابی را به یک مصنوع قابل بررسی تبدیل کرد. به گفته BleepingComputer که جزئیات را گزارش کرده است، پیشرفتهای خاص شامل اثبات وجود گروههای غیرصوفی، حل یک سوال باز اصلی در نظریه گروه است. رد حدس سفتی کونس. محدودیتهای جدید برای بستهبندی کرهای با ابعاد بالا؛ و نتایج حل مشکلات متعددی است که در اصل توسط ریاضیدان پرکار پل اردوس مطرح شده بود.
OpenAI خاطرنشان کرد که تعداد کل توکنهای مورد نیاز برای یافتن این راهحلها با نرخهای API فعلی، تقریباً 2000 دلار هزینه خواهد داشت – یک نقطه داده قابل توجه در مورد ردپای محاسباتی اکتشافات ریاضی مدرن، و چیزی که تحقیقات سطح مرزی را به جای خود آزمایشگاهها، در دسترس تیمهای دانشگاهی با بودجه خوب قرار میدهد.
ریاضیدانان واکنش نشان می دهند
به گزارش The Decoder، توماس بلوم، ریاضیدان دانشگاه منچستر که سایت مرجع Erdős-problem erdosproblems.com را اداره می کند، نتایج را "خبر بزرگ" در X نامید. او آنها را مهمتر از مثالی برای حدس فاصله واحد منتشر شده در ماه می ارزیابی کرد. بلوم نوشت: "شاید بزرگتر از اثبات فاصله واحد نباشد، اما از نظر ساخت و ساز، این بزرگ است."
بلوم همچنین از چارچوبی که هوش مصنوعی جایگزین ریاضیدانان می شود عقب نشینی کرد و استدلال کرد که این ادعا زمانی که این سیستم از بیش از یک قرن تئوری استفاده می کند، توسط ریاضیدانان ساخته شده و بر روی هر چیزی که ریاضیدانان تا به حال نوشته اند آموزش دیده است، منطقی نیست.
نوام براون، محققی که پشت فناوری استدلال زمان آزمایشی که Astra به آن متکی است، بیشتر اندازه گیری شد. او با اشاره به هفت مسئله معروفی که موسسه ریاضیات Clay هر کدام 1 میلیون دلار برای آن ها ارائه می دهد، در X پست کرد: «متاسفانه، (هنوز) هیچ مشکلی برای جایزه هزاره وجود ندارد - تنها یکی از آنها از زمان اعلام جوایز در سال 2000 حل شده است.همه تحت تأثیر قرار نگرفتند. گری مارکوس، منتقد هوش مصنوعی، این مدل را در یک پست Substack «شگفتانگیز – اما بسیار بیش از حد فروخته شد» نامید. تنش بین دستاوردهای فنی واقعی و چارچوب های تبلیغاتی احتمالاً نحوه دریافت Astra را مشخص می کند.
یک خانواده مدل جدید برای کارهای طولانی
اطلاعات به طور مستقل تأیید کرد که Astra یک خانواده مدل جدید است که برای بارهای کاری طولانی مدت ساخته شده است. OpenAI آن را بهعنوان سیستمی توصیف میکند که به چندین عامل هوش مصنوعی اجازه میدهد در بخشهای مختلف یک مشکل بزرگتر با یکدیگر همکاری کنند - طراحی با هدف دقیقاً کارهایی که ساعتها یا روزها طول میکشند تا ثانیهها، مانند اثبات یک قضیه یا بازسازی یک پایگاه کد بزرگ.
BleepingComputer گزارش داد که OpenAI تصمیم نگرفته است که آیا این مدل با نامهای GPT-5.7، GPT-6 یا با نام دیگری عرضه خواهد شد. The Decoder گزارش داد که سام آلتمن، مدیر عامل شرکت Astra را در واشنگتن دی سی به نمایش گذاشته است و نشان می دهد که این شرکت سیستم را به اندازه کافی بالغ می بیند که بتواند در مقابل سیاست گذاران قرار دهد.
مانع بررسی دولت
شاید مهم ترین جزئیات مربوط به مقررات باشد. به گفته The Decoder، Astra یکی از اولین مدلهایی است که فرآیند بررسی برنامهریزی شده دولت ایالات متحده را طی میکند که قبل از انتشار عمومی نیاز به تایید رسمی دارد. این یک لایه عدم قطعیت سیاسی را به جدول زمانی عرضه میافزاید که مدلهای پرچمدار قبلی هرگز با آن مواجه نبودند - و خطرات را برای چگونگی توصیف OpenAI از قابلیتهای Astra افزایش میدهد.
اولین بازی همچنین در میان یک مسابقه سنگین وزن آزاد از راه می رسد. چند روز قبل، Thinking Machines Lab مدل وزن باز Inkling-Small خود را منتشر کرد و آزمایشگاههای چینی همچنان به پیشبرد سیستمهای مرزی با وزن باز ادامه میدهند. Astra به شرط OpenAI هشدار می دهد که استدلال اختصاصی و در مقیاس بزرگ - که توسط ابزارهایی مانند Lean تأیید شده است - همچنان مسیر بزرگ ترین پیشرفت ها است.
در حال حاضر، Astra منتشر نشده باقی مانده است. اما اولین بازی ریاضی آن قبلاً این گفتگو را در مورد اینکه چه سیستمهای هوش مصنوعی مرزی میتوانند به علم ناب کمک کنند و اینکه مردم چقدر باید ادعاهای همراه با آنها را به دقت بررسی کنند، بازنگری کرده است.
از هوش مصنوعی جلوتر بمانید
آیا می خواهید با پیشرفت هایی مانند Astra و مسابقه مدل های مرزی گسترده تر همراه باشید؟ مرکز ما را برای [آخرین پیشرفتهای هوش مصنوعی] (https://aibuzzwire.news) نشانکگذاری کنید.
بیشتر بخوانید اخبار هوش مصنوعی →