AMD आणि Cerebras Systems ने एक नवीन प्रकारची AI inference इन्फ्रास्ट्रक्चर तयार करण्यासाठी तांत्रिक भागीदारीचे अनावरण केले आहे, AMD च्या रॅक-स्केल हेलिओस प्लॅटफॉर्मला सेरेब्रासच्या वेफर-स्केल इंजिन (WSE) सह एकाच, वेगळ्या वर्कफ्लोमध्ये एकत्र केले आहे. 23 जुलै 2026 रोजी AMD च्या Advancing AI 2026 इव्हेंटमध्ये घोषित करण्यात आलेले, सहयोगाने लेटेंसी आणि थ्रूपुट अडथळ्यांना थेट लक्ष्य केले आहे ज्यामुळे जनरेटिव्ह एआय युगातील सर्वात महाग समस्यांपैकी एक आहे. उद्योगाच्या या वेगाने पुढे जाणाऱ्या कोपऱ्याच्या ताज्या माहितीसाठी, आमच्या ब्रेकिंग एआय न्यूज कव्हरेजचे अनुसरण करा.

सर्व काही करण्यासाठी एका चिपला सक्ती करणे थांबवणे ही मूळ कल्पना आहे. पारंपारिक अनुमान स्टॅकमध्ये, एकल GPU कुटुंब प्रॉम्प्ट पचवण्याचे भारी प्रीफिल कार्य आणि प्रत्येक नवीन टोकन तयार करण्याचे नाजूक, अनुक्रमिक काम दोन्ही हाताळते. ती एक तडजोड आहे, कारण दोन नोकऱ्यांच्या खूप वेगळ्या मागण्या आहेत. एएमडी आणि सेरेब्रास असा युक्तिवाद करतात की कामाचे विभाजन करणे, एक तंत्र ज्याला डिसॅग्रिगेटेड इन्फेरेन्स म्हणतात, प्रत्येक इंजिनला ते सर्वोत्तम आहे ते करू देते.

दोन इंजिन श्रमांचे विभाजन कसे करतात

AMD च्या अधिकृत घोषणेनुसार, AMD Helios उच्च-कार्यक्षमता, स्केलेबल थ्रूपुट इंजिन म्हणून काम करेल, इनपुटच्या मोठ्या बॅचवर वेगाने प्रक्रिया करण्यासाठी AMD Instinct GPU वर रेखांकन करेल. सेरेब्रास वेफर-स्केल इंजिन, यादरम्यान, अल्ट्रा-फास्ट, अल्ट्रा-लो-लेटन्सी डीकोड आणि टोकन जनरेशन हाताळेल. सेरेब्राच्या चिप्स वैयक्तिक डायजमध्ये कापण्याऐवजी संपूर्ण वेफर्सवर बांधल्या जातात, ज्यामुळे त्यांना प्रचंड ऑन-चिप मेमरी बँडविड्थ मिळते जी विशेषत: स्टॉल न ठेवता टोकन आउट करण्यासाठी योग्य आहे.

कंपन्यांचे म्हणणे आहे की दोन कॉम्प्युट इंजिन एकत्र करून, संयुक्त सोल्यूशन प्रति वॅट प्रति सेकंद 5x जास्त टोकन वितरीत करणे अपेक्षित आहे, एक मेट्रिक जे अनुमान अर्थशास्त्रासाठी केंद्रीय स्कोअरकार्ड बनले आहे कारण प्रदाते वेग आणि ऊर्जा दोन्ही खर्चांवर स्पर्धा करतात. AMD च्या प्रेस रीलिझमध्ये हा आकडा उद्धृत करण्यात आला होता आणि टॉम्स हार्डवेअर, इन्व्हेस्टिंग डॉट कॉम आणि याहू टेकसह सर्व आउटलेटवर अहवाल दिला गेला होता.

Nvidia च्या वर्चस्वावर एक शॉट

भागीदारी देखील एक धोरणात्मक संकेत आहे. Nvidia ची CUDA इकोसिस्टम आणि GPU लाइनअप सध्या AI प्रशिक्षण आणि अनुमानांवर वर्चस्व गाजवत आहे आणि आव्हानकर्त्यांनी वाढत्या निष्कर्षापर्यंत पोहोचले आहे की एकाच आर्किटेक्चरवर विद्यमान डोके वर मारणे कठीण आहे. बिझनेस इनसाइडरने एएमडीने अनुमानावर सट्टेबाजी करून Nvidia वर शॉट घेतल्याने करार तयार केला, मॉडेल्सच्या विकासापासून उत्पादनाकडे जाताना एआय कंप्युटिंगचा टप्पा वेगाने वाढण्याची अपेक्षा आहे.

AMD साठी, सेरेब्रास सोबत जोडल्याने प्रशिक्षणाच्या पलीकडे त्याच्या इन्स्टिंक्ट आणि हेलिओस रोडमॅपचे आकर्षण विस्तृत होते. सेरेब्राससाठी, जे AMD (NASDAQ: AMD) सोबत टिकर CBRS अंतर्गत Nasdaq वर व्यापार करतात, एका प्रमुख प्रवेगक विक्रेत्याशी एकत्रित केल्याने त्यांच्या वेफर-स्केल तंत्रज्ञानाला मोठ्या उद्योग आणि क्लाउड उपयोजनांमध्ये एक स्पष्ट मार्ग मिळतो. सेरेब्रासने त्याच्या स्वत:च्या डेटा सेंटर्समध्ये AMD Helios तैनात करण्याची योजना आखली आहे आणि कंपन्यांना 2026 च्या उत्तरार्धात सेरेब्रास क्लाउडद्वारे संयुक्त समाधान प्रथम उपलब्ध होण्याची अपेक्षा आहे.

आता वेगळे करणे महत्त्वाचे का आहे

अनुमान खर्च हा एआय उद्योगासाठी एक निश्चित दबाव बिंदू बनला आहे. जसजसे मॉडेल मोठे होतात आणि अनुप्रयोगांना रिअल-टाइम प्रतिसादांची मागणी होते, प्रत्येक टोकन व्युत्पन्न करण्याचा खर्च आणि विलंब वापरकर्त्यांना त्याची वाट पाहण्याचा अनुभव येतो, ते उत्पादन व्यवहार्य आहे की नाही हे निर्धारित करू शकतात. विभक्त अनुमान प्रीफिल आणि डीकोडला वेगळे वर्कलोड मानतात जे प्रत्येकाशी सर्वोत्तम जुळलेल्या हार्डवेअरकडे राउट केले जाऊ शकतात, सेरेब्रा सारख्या कंपन्यांनी एक वर्षाहून अधिक काळ चॅम्पियन केलेले डिझाइन तत्त्वज्ञान.

एएमडी-सेरेब्रास घोषणा सूचित करते की दृष्टीकोन बंडखोर कल्पनेकडून उद्योग-समर्थित आर्किटेक्चरकडे जात आहे. थ्रूपुट स्पेशालिस्टला लेटन्सी स्पेशालिस्ट सोबत जोडून, ​​दोन्ही कंपन्या पैज लावत आहेत की अनुमानाचे भवितव्य या सर्वांवर राज्य करणारी एक चिप नाही तर विशेष इंजिनची एक समन्वित प्रणाली आहे.

काय पहावे

अनेक प्रश्न शिल्लक आहेत. 5x टोकन-प्रति-सेकंद-प्रति-वॅट आकृती ही तृतीय-पक्षाच्या बेंचमार्कपेक्षा एक अपेक्षा आहे आणि वास्तविक-जगातील कामगिरी विशिष्ट मॉडेल्स आणि ग्राहक चालवलेल्या वर्कलोडवर अवलंबून असेल. सेरेब्रास क्लाउड लॉन्चच्या पलीकडे किंमत आणि उपलब्धता तपशील उघड केले गेले नाहीत आणि हे समाधान इतर क्लाउड प्रदात्यांपर्यंत कधी पोहोचेल हे स्पष्ट नाही.

तरीही, हा करार एआय हार्डवेअरमध्ये व्यापक बदल अधोरेखित करतो: एकल जीपीयू आर्किटेक्चर एआय पाइपलाइनच्या प्रत्येक टप्प्यावर काम करेल हे गृहीतक आहे. जर एएमडी आणि सेरेब्रास त्यांचे कार्यक्षमतेचे दावे पूर्ण करू शकतील, तर सर्वांत मोठ्या एआय प्रणाली कशा तयार केल्या जातात याचा विभक्त अनुमान हा एक मानक भाग बनू शकतो.

AI च्या पुढे रहा

AI हार्डवेअर लँडस्केप विशेष शिबिरांमध्ये विभागले जात आहे, आणि किंमत, वेग आणि स्पर्धेचे परिणाम प्रचंड आहेत. AI Buzz Wire वर अधिक AI बातम्या वाचा प्रत्येक मोठी डील, रिलीज आणि बेंचमार्क लक्षात ठेवण्यासाठी.