सेरेब्रास सिस्टीम्स आणि ओपनएआयने अल्ट्राफास्ट मोडचा प्रारंभिक देखावा शेअर केला आहे, जो OpenAI API मध्ये प्रथम लॉन्च होणारा आणि सेरेब्रास वेफर-स्केल तंत्रज्ञानाद्वारे समर्थित नवीन सेवा स्तर आहे. भागीदारी GPT-5.6 सोलला प्रति सेकंद 750 आउटपुट टोकन्स चालवण्यास सक्षम करते, रिअल-टाइम वेगाने फ्रंटियर-स्तरीय बुद्धिमत्ता वितरीत करते. नवीनतम AI हार्डवेअर बातम्यांसाठी, AI Buzz Wire ला भेट द्या.
स्पीड-इंटेलिजन्स ट्रेडऑफ काढून टाकणे
एआय बिल्डर्सना दीर्घ काळापासून मूलभूत व्यवहाराचा सामना करावा लागला आहे: मॉडेल्सचा आकार आणि बुद्धिमत्ता वाढल्याने, त्यांना उच्च संगणकीय आणि डेटा हालचाल खर्च येतो, प्रतिसाद वेळ कमी होतो. उच्च-गुणवत्तेच्या परिणामांची प्रतीक्षा करणे किंवा कमी वेळेत निकृष्ट निकाल स्वीकारणे यापैकी एक निवडणे विकसकांना भाग पडले.
GPT-5.6 सोल ऑन अल्ट्राफास्ट मोड ही कोंडी सोडवण्यासाठी डिझाइन केले आहे. सेरेब्रासच्या मते, आर्टिफिशियल ॲनालिसिसने नोंदवलेल्या आउटपुट स्पीडच्या आधारे ही सेवा अँथ्रोपिकच्या क्लॉड फेबल 5 पेक्षा 11 पट वेगाने आणि फास्ट मोडवर Opus 4.8 पेक्षा 5 पट वेगाने चालते.
मानवतेची शेवटची परीक्षा: गती चाचणी
सेरेब्रासने ह्युमॅनिटीज लास्ट एक्झाम (HLE) वरील प्रतिस्पर्धी मॉडेल्सच्या विरोधात अल्ट्राफास्टची चाचणी घेतली, एक आव्हानात्मक बेंचमार्क ज्यामध्ये 2,500 प्रश्न असतात ज्यांना सामान्यत: रसायनशास्त्र, अर्थशास्त्र आणि साहित्य यासारख्या क्षेत्रात पीएचडी धारकांनाच उत्तर दिले जाते.
सेरेब्रासने केलेल्या मूल्यांकनांमध्ये, अल्ट्राफास्ट मोडवर GPT-5.6 सोलने 11 तास आणि 11 मिनिटांत सर्व 2,500 HLE प्रश्नांची उत्तरे दिली. क्लॉड फेबल 5 ला समान निष्कर्षापर्यंत पोहोचण्यासाठी 78 तास आणि 27 मिनिटे, तीन दिवसांपेक्षा जास्त सतत गणना करणे आवश्यक आहे. दुसऱ्या शब्दांत, अल्ट्राफास्टने एकाच कामकाजाच्या दिवसात मानवी ज्ञानाच्या सीमारेषेवर प्रक्रिया केली, तुलनात्मक अचूकता जवळजवळ सात पट वेगाने प्राप्त केली.
10 जुलै रोजी उच्च तर्क सेटिंग्जवर कोडेक्ससह GPT-5.6 सोल अल्ट्राफास्ट आणि 13 ते 15 जुलै दरम्यान उच्च तर्क सेटिंग्जवर क्लॉड फेबल 5 आणि क्लॉड कोड वापरून सेरेब्रासने बेंचमार्किंग केले.
वास्तविक-जागतिक व्यवसाय प्रभाव
GDP-Val वर, आर्थिकदृष्ट्या मौल्यवान ज्ञान कार्य कार्यांसाठी एक बेंचमार्क, Ultrafast ने कोणत्याही गुणवत्तेचा ऱ्हास न करता 5.6x एंड-टू-एंड स्पीडअप दिला. हे दर्शविते की आउटपुट गुणवत्तेचा त्याग न करता किती वेगवान अनुमान आर्थिकदृष्ट्या मौल्यवान कामाला गती देऊ शकते.
सेरेब्रासने अल्ट्राफास्टची कल्पना अशा परिस्थितींसाठी एक साधन म्हणून केली आहे जिथे प्रत्येक सेकंदाला महत्त्व आहे. वेब सेवा ऑपरेट करणाऱ्या कंपन्या या तंत्रज्ञानाचा वापर मूळ कारणासाठी आणि उत्पादनातील अडथळे दूर करण्यासाठी, ग्राहकांचा विश्वास टिकवून ठेवण्यासाठी आणि गमावलेला महसूल रोखण्यासाठी वापरू शकतात. हाय-स्टेक सायबर सिक्युरिटी परिस्थितींमध्ये, सुरक्षा टीम हल्ले शोधण्यासाठी आणि त्यांना वेगाने प्रतिसाद देण्यासाठी अल्ट्राफास्टचा फायदा घेऊ शकतात.
वेगामागील तंत्रज्ञान
कामगिरीचा फायदा सेरेब्रासच्या वेफर-स्केल इंजिन आर्किटेक्चरमुळे होतो, जे फ्रंटियर एआय वर्कलोड्ससाठी उद्देशाने तयार केलेले आहे. फास्ट फ्रंटियर इन्फरन्सचे मुख्य आव्हान म्हणजे डेटा हालचाल समस्या आहे: पारंपारिक GPU वर, मोठ्या मॉडेल्सवरील अनुमान मेमरी बँडविड्थने अडथळे आणले आहे, कारण सलग टोकन तयार करण्यासाठी मॉडेलचे वजन ऑन-चिप मेमरी आणि ऑफ-चिप स्टोरेज दरम्यान वारंवार हस्तांतरित केले जाणे आवश्यक आहे.
सेरेब्रास मूलभूतपणे भिन्न दृष्टीकोन घेतात. प्रत्येक वेफर-आकाराची चिप 44 GB SRAM थेट सिलिकॉनवर पॅक करते. मॉडेल वेट ऑन-चिप राहतात आणि टोकन्स वेफर्समध्ये पाइपलाइन केलेल्या मॉडेल लेयर्समधून अखंडपणे प्रवाहित होतात. हे अकार्यक्षम डेटा हालचाल काढून टाकते जी GPU-आधारित अनुमान कमी करते आणि मॉडेल आकारासह सहजतेने स्केल करते, भविष्यातील फ्रंटियर मॉडेल्सवर सतत गतीचा फायदा मिळवण्याचा मार्ग मोकळा करते.
उपलब्धता आणि मार्केट पोझिशनिंग
GPT-5.6 सोल ऑन अल्ट्राफास्ट मोड सध्या मर्यादित पूर्वावलोकनामध्ये ग्राहकांच्या निवडक गटासाठी उपलब्ध आहे, जसजसे क्षमता वाढते तसतसे प्रवेशाचा विस्तार होतो. सेरेब्रास भागीदारीचे वर्णन AI इनोव्हेशनच्या पुढील लाटेला शक्ती देणारे आणि प्रतिसादात्मक AI सह संस्था काय करू शकतात याची कमाल मर्यादा वाढवते.
सहयोग सेरेब्राससाठी एक महत्त्वपूर्ण मैलाचा दगड आहे, ज्याने GPU-वर्चस्व असलेल्या AI हार्डवेअर मार्केटला पर्याय म्हणून वेफर-स्केल कॉम्प्युटिंगचा दीर्घकाळ पाठपुरावा केला आहे. उपलब्ध असलेल्या सर्वात सक्षम फ्रंटियर मॉडेल्सपैकी एकाला गती देण्यासाठी OpenAI सोबत थेट भागीदारी करून, सेरेब्रास एक मजबूत केस बनवत आहे की त्याची आर्किटेक्चर उच्च-गती अनुमान वर्कलोडसाठी एक वास्तविक स्पर्धात्मक फायदा देते.
मॉडेल्स मोठे आणि अधिक हुशार होत असताना, त्यांना रिअल-टाइम वेगाने सेवा देण्याची क्षमता एआय इन्फ्रास्ट्रक्चर मार्केटमध्ये एक निश्चित स्पर्धात्मक घटक बनू शकते. सेरेब्रास-ओपनएआय भागीदारी सूचित करते की अनुमानित गतीची शर्यत आता मॉडेल बुद्धिमत्तेच्या शर्यतीइतकीच महत्त्वाची आहे.
AI च्या पुढे रहा
अधिक AI हार्डवेअर बातम्या, मॉडेल कार्यप्रदर्शन विश्लेषण आणि उद्योग विकासासाठी, बुकमार्क AI Buzz Wire.
अधिक AI बातम्या वाचा →