OpenAI ने एस्ट्रा से पर्दा हटा दिया है, एक अप्रकाशित प्रणाली जिसे वह "हमारा अगला प्रमुख मॉडल" कहता है, इसके आंतरिक संस्करण के बाद गणित और सैद्धांतिक कंप्यूटर विज्ञान में दस महत्वपूर्ण प्रगति हुई है। कंपनी ने गणितीय परिणामों का दस्तावेजीकरण करने वाले एक शोध पोस्ट के अंदर घोषणा को छिपा दिया, जिससे [ब्रेकिंग एआई न्यूज] (https://aibuzzwire.news) को करीब से फॉलो करने वाले शोधकर्ताओं में उत्साह और जांच दोनों बढ़ गई।

एस्ट्रा ने जिन समस्याओं को हल करने में मदद की, ओपनएआई ने लिखा, "कम से कम एक दशक तक उनके केंद्रीय परिणामों पर कोई प्रगति नहीं हुई, और ज्यादातर मामलों में, बहुत लंबे समय तक।" परिणाम उच्च-आयामी ज्यामिति, कोडिंग सिद्धांत, अंकगणितीय सर्किट जटिलता, समूह सिद्धांत, क्वांटम जटिलता, जाली क्रिप्टोग्राफी और चरम कॉम्बिनेटरिक्स सहित क्षेत्रों में फैले हुए हैं - ऐसा क्षेत्र जहां प्रगति आमतौर पर वर्षों में मापी जाती है, एक भी शोध नहीं चलता है।

सत्यापित प्रमाण, केवल उत्तर नहीं

गणित में अनुमान लगाने वाले चैटबॉट से एस्ट्रा के आउटपुट को जो अलग करता है वह सत्यापन है। ओपनएआई ने कहा कि मानव शोधकर्ताओं ने पांडुलिपियों के रूप में तर्क तैयार करने के लिए उसी मॉडल का उपयोग किया, और एस्ट्रा ने फिर प्रत्येक तर्क को लीन सर्टिफिकेट के रूप में औपचारिक रूप दिया। लीन एक ओपन-सोर्स प्रूफ सहायक है जो गणितीय तर्कों की मशीन-जांच कर सकता है, जिसका अर्थ है कि अन्य गणितज्ञों को विश्वास पर परिणाम लेने की ज़रूरत नहीं है - उन्हें सेकंड में सॉफ्टवेयर द्वारा स्वतंत्र रूप से सत्यापित किया जा सकता है।

वह भेद मायने रखता है. एक भाषा मॉडल एक विश्वसनीय दिखने वाला प्रमाण प्रस्तुत कर सकता है जिसमें एक सूक्ष्म, घातक त्रुटि होती है। प्रत्येक तर्क को लीन में अनुवाद करके, ओपनएआई ने एक मार्केटिंग दावे को एक जांच योग्य आर्टिफैक्ट में बदल दिया। ब्लीपिंगकंप्यूटर के अनुसार, जिसने विवरण की सूचना दी, विशिष्ट प्रगति में गैर-सामाजिक समूहों के अस्तित्व को स्थापित करने वाला प्रमाण, समूह सिद्धांत में एक प्रमुख खुले प्रश्न का समाधान शामिल है; कॉन्स की कठोरता अनुमान का खंडन; उच्च-आयामी क्षेत्र पैकिंग के लिए नई सीमाएँ; और मूल रूप से विपुल गणितज्ञ पॉल एर्डोस द्वारा प्रस्तुत की गई कई समस्याओं का समाधान करने के परिणाम सामने आए।

ओपनएआई ने नोट किया कि इन समाधानों को खोजने के लिए आवश्यक टोकन की कुल संख्या की लागत मौजूदा एपीआई दरों पर लगभग 2,000 डॉलर होगी - आधुनिक गणितीय खोज की गणना पदचिह्न के बारे में एक हड़ताली डेटा बिंदु, और एक जो केवल प्रयोगशालाओं के बजाय अच्छी तरह से वित्त पोषित शैक्षणिक टीमों की पहुंच के भीतर अग्रणी स्तर के अनुसंधान को रखता है।

गणितज्ञों की प्रतिक्रिया

मैनचेस्टर विश्वविद्यालय के गणितज्ञ थॉमस ब्लूम, जो एर्दो-समस्या संदर्भ साइट erdosproblems.com चलाते हैं, ने द डिकोडर के अनुसार, एक्स पर परिणामों को "बड़ी खबर" कहा। उन्होंने मई में प्रकाशित इकाई दूरी अनुमान के प्रतिउदाहरण की तुलना में उन्हें अधिक महत्वपूर्ण दर्जा दिया। ब्लूम ने लिखा, "शायद इकाई दूरी के प्रमाण से बड़ा नहीं होता, लेकिन निर्माण के संदर्भ में, यह बड़ा है।"

ब्लूम ने इस धारणा का भी विरोध किया कि एआई गणितज्ञों की जगह ले रहा है, यह तर्क देते हुए कि इस दावे का कोई मतलब नहीं है जब सिस्टम एक सदी से अधिक के सिद्धांत पर आधारित है, गणितज्ञों द्वारा बनाया गया था, और गणितज्ञों ने जो कुछ भी लिखा है उस पर प्रशिक्षित किया गया था।

नोम ब्राउन, परीक्षण-समय तर्क तकनीक के पीछे एक शोधकर्ता जिस पर एस्ट्रा भरोसा करता है, अधिक मापा गया था। "अफसोस की बात है, कोई मिलेनियम पुरस्कार समस्या (अभी तक) नहीं है," उन्होंने एक्स पर पोस्ट किया, जिसमें उन सात प्रसिद्ध समस्याओं का जिक्र किया गया है जिनके लिए क्ले मैथमेटिक्स इंस्टीट्यूट प्रत्येक को 1 मिलियन डॉलर की पेशकश करता है - 2000 में पुरस्कारों की घोषणा के बाद से केवल एक को हल किया गया है।

हर कोई प्रभावित नहीं हुआ. एआई समीक्षक गैरी मार्कस ने सबस्टैक पोस्ट में मॉडल को "अद्भुत - लेकिन बहुत अधिक बिकने वाला" कहा, जब भी कोई सीमांत प्रयोगशाला एक मील का पत्थर का दावा करती है तो संदेह की एक परिचित रेखा होती है। वास्तविक तकनीकी उपलब्धि और प्रचारात्मक रूपरेखा के बीच तनाव यह परिभाषित करने की संभावना है कि एस्ट्रा को कैसे प्राप्त किया जाता है।

लंबे कार्यों के लिए एक नया आदर्श परिवार

सूचना ने स्वतंत्र रूप से पुष्टि की कि एस्ट्रा लंबे समय तक चलने वाले कार्यभार के लिए बनाया गया एक नया मॉडल परिवार है। ओपनएआई इसे एक ऐसी प्रणाली के रूप में वर्णित करता है जो कई एआई एजेंटों को एक बड़ी समस्या के विभिन्न हिस्सों पर सहयोग करने देती है - एक डिज़ाइन जिसका उद्देश्य ऐसे कार्यों पर होता है जिनमें सेकंड के बजाय घंटों या दिन लगते हैं, जैसे कि एक प्रमेय साबित करना या एक बड़े कोडबेस को दोबारा तैयार करना।

ब्लीपिंगकंप्यूटर ने बताया कि ओपनएआई ने यह तय नहीं किया है कि मॉडल जीपीटी-5.7, जीपीटी-6, या किसी अन्य नाम के तहत भेजा जाएगा। द डिकोडर की रिपोर्ट के अनुसार, सीईओ सैम अल्टमैन पहले ही वाशिंगटन, डी.सी. में एस्ट्रा का प्रदर्शन कर चुके हैं, जिससे संकेत मिलता है कि कंपनी सिस्टम को नीति निर्माताओं के सामने रखने के लिए पर्याप्त परिपक्व मानती है।

एक सरकारी समीक्षा बाधा

शायद सबसे परिणामी विवरण नियामक है। द डिकोडर के अनुसार, एस्ट्रा नियोजित अमेरिकी सरकार की समीक्षा प्रक्रिया से गुजरने वाले पहले मॉडलों में से एक होगी जिसके लिए सार्वजनिक रिलीज से पहले आधिकारिक मंजूरी की आवश्यकता होती है। यह लॉन्च टाइमलाइन में राजनीतिक अनिश्चितता की एक परत जोड़ता है जिसका पहले के प्रमुख मॉडलों ने कभी सामना नहीं किया था - और ओपनएआई एस्ट्रा की क्षमताओं को कैसे चित्रित करता है, इसके लिए दांव बढ़ाता है।

भयंकर ओपन-वेट रेस के बीच भी पदार्पण होता है। कुछ दिन पहले, थिंकिंग मशीन्स लैब ने अपना इंकलिंग-स्मॉल ओपन-वेट मॉडल जारी किया था, और चीनी लैब ओपन-वेट फ्रंटियर सिस्टम को आगे बढ़ाना जारी रखे हुए हैं। एस्ट्रा ओपनएआई के इस दावे का संकेत देता है कि मालिकाना, बड़े पैमाने पर तर्क - लीन जैसे उपकरणों द्वारा सत्यापित - सबसे बड़ी सफलताओं का मार्ग बना हुआ है।

अभी के लिए, एस्ट्रा अप्रकाशित है। लेकिन इसकी गणितीय शुरुआत ने पहले से ही इस बातचीत को फिर से शुरू कर दिया है कि फ्रंटियर एआई सिस्टम शुद्ध विज्ञान में क्या योगदान दे सकता है, और जनता को उनके साथ आने वाले दावों की कितनी बारीकी से जांच करनी चाहिए।

एआई से आगे रहें

क्या आप एस्ट्रा जैसे विकास और व्यापक सीमांत-मॉडल दौड़ के साथ बने रहना चाहते हैं? नवीनतम एआई विकास के लिए हमारे हब को बुकमार्क करें।

अधिक AI समाचार पढ़ें →