सेरेब्रासने CS-4, त्याच्या नवीन WSE-3 टर्बो वेफर-स्केल प्रोसेसरभोवती तयार केलेली रॅक-स्केल AI अनुमान प्रणाली बंद केली आहे, आणि दावा केला आहे की मशीन GPU-आधारित प्रणालींपेक्षा 30 पट अधिक वेगवान अनुमान वितरीत करते कारण कंपनी स्वतःला Nvidia च्या डेटा सेंटर साम्राज्याचा वेग पर्याय म्हणून स्थान देते.
लॉन्च, मंगळवारी घोषित केले गेले आणि कंपनीच्या उत्पादन पृष्ठांवर तपशीलवार आणि रॉयटर्स, ब्लूमबर्ग आणि द रजिस्टर कडून कव्हरेजची एक लहर, सार्वजनिक झाल्यापासून सेरेब्रासचे सर्वात लक्षणीय हार्डवेअर रीफ्रेश चिन्हांकित करते — आणि ज्या कंपनीचा स्टॉक तिच्या IPO पासून संघर्ष करत आहे अशा कंपनीसाठी एक निर्णायक क्षण आहे. गुंतवणूकदार लक्ष देत असल्याचे दिसते: सेरेब्रास (CBRS) चे शेअर्स या बातमीवर वाढले आणि इन्व्हेस्टर्स बिझनेस डेलीने सीईओचे भाष्य उद्धृत केले की एआय अनुमान बाजार "इतक्या वेगाने वाढत आहे."
AI मॉडेल्सना जलद प्रतिसाद देण्यासाठी प्रवेगक शर्यतीचा मागोवा घेणाऱ्या वाचकांसाठी, CS-4 लाँच ही तिमाहीतील सर्वात परिणामकारक हार्डवेअर कथांपैकी एक आहे आणि ती AI उद्योग कव्हरेजमधील व्यापक बदलांच्या दरम्यान आली आहे जी संगणकीय लँडस्केपला पुन्हा आकार देत आहे.
CS-4 च्या आत काय आहे
हेडलाइन घटक WSE-3 टर्बो आहे, सेरेब्रासच्या डिनर-प्लेट-आकाराच्या वेफर स्केल इंजिनची अपग्रेड केलेली आवृत्ती. द रजिस्टरच्या तांत्रिक सखोल अभ्यासानुसार, WSE-3T हा नवीन सिलिकॉन नाही — तो तीच TSMC 5nm प्रक्रिया, 46,225 स्क्वेअर मिलिमीटर डाय एरिया, 4 ट्रिलियन ट्रान्झिस्टर, 900,000 कोर आणि 44 GB ऑन-वेफर SRAM दोन वर्षे जुना WSE म्हणून राखून ठेवतो.
त्याऐवजी, सेरेब्रासने विद्यमान चिपला अधिक कठोरपणे ढकलून त्याची कार्यक्षमता दुप्पट केली. WSE-3T विरळ FP16 गणना 250 petaFLOPS वर दुप्पट करते, दाट FP16 कार्यप्रदर्शन अंदाजे 25 petaFLOPS पर्यंत दुप्पट करते, मेमरी बँडविड्थ 43.2 पेटाबाइट्स प्रति सेकंद आणि I/O बँडविड्थ दुप्पट करते 2.4 टेराबिट्स प्रति सेकंद. रजिस्टरचा अंदाज आहे की कंपनी आता सिलिकॉनला अंदाजे 2.8 GHz वर क्लॉक करत आहे, जे मागील पिढीतील सुमारे 1.4 GHz होते.
सेरेब्रासच्या मते, युक्ती ही एक पुन्हा डिझाइन केलेली उर्जा वितरण प्रणाली आहे जी प्रोसेसरपासून फक्त 0.5 मिलीमीटरवर बसते - पारंपारिक GPU बोर्डांच्या ~50 मिलीमीटरपेक्षा अंदाजे 100 पट जवळ. त्या समीपतेमुळे बोर्ड-स्तरीय पॉवर लॉस जवळजवळ दूर होतो आणि वेफरपर्यंत दुप्पट पॉवर पोहोचू देते, वेगवान टोकन जनरेशनच्या मागे उच्च ऑपरेटिंग फ्रिक्वेन्सी सक्षम करते.
नेक्सस रॅक आर्किटेक्चर
चिपच्या पलीकडे, CS-4 नेक्सस प्लॅटफॉर्म आर्किटेक्चर ज्याला सेरेब्रास म्हणतात ते सादर करते, त्याचे पहिले खरे रॅक-स्केल डिझाइन आणि Nvidia च्या NVL72 आणि AMD च्या Helios रॅक सिस्टमला थेट उत्तर. प्रत्येक CS-4 स्वयं-निहित "वेफर-स्केल बॅकपॅक" मध्ये ठेवलेले तीन WSE-3T प्रोसेसर घेऊ शकतात - 50% कमी घटकांसह एकाच असेंब्लीमध्ये वेफर, पॉवर कन्व्हर्जन, डायरेक्ट लिक्विड कूलिंग, हाय-स्पीड I/O आणि कंट्रोल इलेक्ट्रॉनिक्स फोल्ड करणारे 3D पॅकेज.
मॉड्यूलर डिझाइन स्थिर उर्जा, कूलिंग आणि नेटवर्क लेयरला गणनापासून वेगळे करते. सेरेब्रास पॉवररॅक स्थापित केले जाऊ शकते आणि कोणतीही गणना येण्यापूर्वी सुविधा-पात्रता प्राप्त केली जाऊ शकते आणि बॅकपॅक नंतर जागेवर सरकतात - कंपनीच्या म्हणण्यानुसार, तैनातीचा वेळ काही दिवसांपासून तासांपर्यंत कमी करते.
वीज वापर लक्षणीय आहे. रजिस्टरमध्ये अंदाजे 46 किलोवॅट प्रति बॅकपॅक आणि एकूण 120 ते 140 किलोवॅट सिस्टम ड्रॉचा अंदाज आहे - लक्षवेधी संख्या जे तरीही 240 ते 250 kW रॅक सिस्टम्सच्या पुढे पुराणमतवादी दिसतात AMD आणि Nvidia या वर्षाच्या शेवटी पाठवण्याची अपेक्षा आहे.
स्विच मारणे
कदाचित सर्वात तांत्रिकदृष्ट्या मनोरंजक पर्याय इंटरकनेक्ट आहे. स्विचेसद्वारे वेफर-टू-वेफर ट्रॅफिक रूट करण्याऐवजी — AWS ने त्याच्या Trainium3 एक्सीलरेटर्ससाठी अवलंबलेला दृष्टिकोन — सेरेब्रास त्याच्या चिप्सला 2D टोरस टोपोलॉजीमध्ये वायर करते जेथे शेजारील वेफर्स एकमेकांशी थेट बोलतात. डिझाईनमध्ये वेफर-टू-वेफर लेटन्सी पाच मायक्रोसेकंदांवरून फक्त दोनपर्यंत कमी होते आणि सेरेब्रास म्हणतात की जाळी 50 ट्रिलियन पॅरामीटर्सपर्यंतच्या मॉडेलला सपोर्ट करू शकते, सध्या अस्तित्वात असलेल्या कोणत्याही गोष्टीपेक्षा आरामात.
गती परिणाम धक्कादायक आहेत. सिंगल CS-4 सिस्टीमवर, बेंचमार्किंग फर्म आर्टिफिशियल ॲनालिसिसने gpt-oss-120b वर प्रति सेकंद 4,400 टोकन प्रति सेकंदापर्यंत मोजले - आज उपलब्ध असलेल्या सर्वात वेगवान GPU-आधारित अनुमान सेवांच्या प्रति सेकंद ~350 टोकन्सच्या अंदाजे 12 पट. 10 ट्रिलियन पॅरामीटर्सपेक्षा जास्त मॉडेल्सवर सिस्टम प्रति सेकंद 1,000 पेक्षा जास्त टोकन टिकवून ठेवते असाही सेरेब्रासचा दावा आहे.
एक भिन्न भागीदारी धोरण
उल्लेखनीय म्हणजे, सेरेब्रास यापुढे संपूर्ण निष्कर्ष पाइपलाइन स्वतःच्या सिलिकॉनवर चालवण्याचा प्रयत्न करत नाही. Trainium XPUs आणि Instinct GPU वर अनुक्रमे गणना-केंद्रित प्रॉम्प्ट-प्रोसेसिंग स्टेज ऑफलोड करण्यासाठी कंपनीने AWS आणि AMD सोबत भागीदारी केली आहे, लेटन्सी-सेन्सिटिव्ह डीकोड टप्पा हाताळण्यासाठी तिची वेफर-स्केल इंजिने सोडली आहेत जिथे त्यांचे प्रचंड SRAM साठे चमकतात.
CS-4 लाँचने सेरेब्रासचे OpenAI सह सहकार्य देखील वाढवले आहे. Yahoo फायनान्सने नवीन OpenAI आणि AMD भागीदारी सोबत अनावरणाची नोंद केली आहे ज्याचा उद्देश AI अनुमानांना गती देण्याच्या उद्देशाने आहे - कंपन्यांनी ऑगस्टमध्ये सादर केलेल्या अल्ट्राफास्ट मोडवर उभारणी, ज्याने वापरकर्त्यांना GPT-5.6 सोल प्रति सेकंद 750 टोकन पर्यंत आणले.
हेडलाइन नंबरच्या मागे चेतावणी
उद्योग विश्लेषकांनी विपणन आकड्यांबाबत काही सावधगिरी बाळगण्याचे आवाहन केले आहे. नोंदणी नोंदवते की सेरेब्रासची हेडलाइन 250 petaFLOPS विलक्षणतेवर अवलंबून आहे, ज्याचा सामान्यतः मोठ्या भाषेच्या मॉडेल अनुमानांना फायदा होत नाही आणि ते पीक मेमरी बँडविड्थ आकडे मोठ्या प्रमाणावर सैद्धांतिक आहेत कारण WSE-3 मध्ये स्वतःचे SRAM संतृप्त करण्यासाठी गणनाची कमतरता आहे. सेरेब्राने SRAM क्षमता वाढवण्याऐवजी कार्यप्रदर्शन दुप्पट का केले असा प्रश्न देखील केला आहे, जे पाच वर्षांपूर्वी WSE-2 लाँच झाल्यापासून अर्थपूर्णपणे वाढले नाही - डिकोड प्रवेगकांना मेमरीचा सर्वाधिक फायदा होतो अशा विसंगत अनुमानांच्या युगातील एक उत्सुक निवड.
तरीही, बाजाराची संधी खरी आहे. एआय चॅटबॉट्स आणि एजंट्सना अधिक वेगवान प्रतिसाद वेळेची मागणी असल्याने, अनुमान गती हा एक अस्सल स्पर्धात्मक भिन्नता बनला आहे आणि सेरेब्रासने आता हे दाखवून दिले आहे की ते व्यावसायिक कॅडन्सवर त्याचे अपारंपरिक वेफर-स्केल तंत्रज्ञान पुनरावृत्ती करू शकते.
पहिली CS-4 शिपमेंट या तिमाहीत सुरू होईल, पहिली प्रणाली सप्टेंबरच्या अखेरीपूर्वी ऑनलाइन अपेक्षित आहे. Nvidia चे वर्चस्व कमी करण्यासाठी ते पुरेसे आहे की नाही हे पाहणे बाकी आहे — परंतु काही काळानंतर प्रथमच, उद्योगातील सर्वात वेगवान AI अनुमानाला एक नवीन पत्ता आहे.
AI च्या पुढे रहा
CS-4 प्रमाणे हार्डवेअर बाजारात आणले जाते आणि AI प्रणाली काय करू शकतात ते पुन्हा परिभाषित करतात. अधिक AI बातम्या वाचा प्रत्येक विकासाची माहिती ठेवण्यासाठी.
नवीनतम AI कव्हरेज एक्सप्लोर करा →