செரிப்ராஸ் அதன் புதிய WSE-3 டர்போ வேஃபர்-அளவிலான செயலியைச் சுற்றி உருவாக்கப்பட்ட ரேக் அளவிலான AI அனுமான அமைப்பான CS-4 ஐ மறைத்துள்ளது, இந்த இயந்திரம் GPU- அடிப்படையிலான அமைப்புகளை விட 30 மடங்கு வேகமான அனுமானத்தை வழங்குகிறது என்று கூறுகிறது, ஏனெனில் நிறுவனம் Nvidia இன் தரவு மையப் பேரரசுக்கு வேக மாற்றாக தன்னை நிலைநிறுத்துகிறது.

வெளியீட்டு, செவ்வாய்கிழமை அறிவிக்கப்பட்டது மற்றும் நிறுவனத்தின் தயாரிப்பு பக்கங்கள் முழுவதும் விரிவானது மற்றும் ராய்ட்டர்ஸ், ப்ளூம்பெர்க் மற்றும் தி ரிஜிஸ்டர் ஆகியவற்றிலிருந்து கவரேஜ் அலை, பொதுவில் சென்றதில் இருந்து செரிப்ராஸின் மிக முக்கியமான வன்பொருள் புதுப்பிப்பைக் குறிக்கிறது - மற்றும் அதன் ஐபிஓவிலிருந்து பங்குகள் போராடிய ஒரு நிறுவனத்திற்கு ஒரு முக்கிய தருணம். முதலீட்டாளர்கள் கவனம் செலுத்துவது போல் தெரிகிறது: செரிப்ராஸ் (CBRS) பங்குகள் இந்தச் செய்தியில் உயர்ந்தன, மேலும் இன்வெஸ்டர்ஸ் பிசினஸ் டெய்லி AI அனுமான சந்தை "மிக வேகமாக வளர்ந்து வருகிறது" என்று CEO வர்ணனையை மேற்கோள் காட்டியது.

AI மாடல்களை வேகமாகப் பதிலளிக்கும் வேகமான பந்தயத்தைக் கண்காணிக்கும் வாசகர்களுக்கு, CS-4 வெளியீட்டு காலாண்டின் மிகவும் விளைவான வன்பொருள் கதைகளில் ஒன்றாகும், மேலும் இது AI தொழில்துறையின் பரந்த மாற்றங்களுக்கு மத்தியில் நிலப்பரப்பை மாற்றியமைக்கிறது.

CS-4 இன் உள்ளே என்ன இருக்கிறது

செரிப்ராஸின் டின்னர்-ப்ளேட் அளவிலான வேஃபர் ஸ்கேல் எஞ்சினின் மேம்படுத்தப்பட்ட பதிப்பான WSE-3 டர்போ என்பது தலைப்புக் கூறு ஆகும். தி ரிஜிஸ்டரின் தொழில்நுட்ப ஆழமான டைவ் படி, WSE-3T புதிய சிலிக்கான் அல்ல - இது அதே TSMC 5nm செயல்முறை, 46,225 சதுர மில்லிமீட்டர் டை ஏரியா, 4 டிரில்லியன் டிரான்சிஸ்டர்கள், 900,000 கோர்கள் மற்றும் 44 GB ஆன்-வேஃபர் SRAM ஐ இரண்டு வருட WSE-3 ஐப் பெற்றுள்ளது.

மாறாக, செரிப்ராஸ் தற்போதுள்ள சிப்பை மிகவும் கடினமாகத் தள்ளுவதன் மூலம் செயல்திறனை இரட்டிப்பாக்கியது. WSE-3T ஸ்பேர்ஸ் FP16 கம்ப்யூட்டை 250 petaFLOPS ஆகவும், அடர்த்தியான FP16 செயல்திறனை 25 petaFLOPS ஆகவும் இரட்டிப்பாக்குகிறது, நினைவக அலைவரிசையை ஒரு வினாடிக்கு 43.2 பெட்டாபைட்டுகளாகவும், I/O அலைவரிசையை வினாடிக்கு 2.4 டெராபிட்டாகவும் இரட்டிப்பாக்குகிறது. முந்தைய தலைமுறையில் சுமார் 1.4 ஜிகாஹெர்ட்ஸ் இருந்த சிலிக்கானை இப்போது நிறுவனம் சுமார் 2.8 ஜிகாஹெர்ட்ஸ் வேகத்தில் பயன்படுத்துகிறது என்று ரெஜிஸ்டர் மதிப்பிடுகிறது.

செரிப்ராஸின் கூற்றுப்படி, இந்த தந்திரம் மறுவடிவமைப்பு செய்யப்பட்ட பவர் டெலிவரி அமைப்பாகும், இது செயலியிலிருந்து 0.5 மில்லிமீட்டர் தொலைவில் உள்ளது - வழக்கமான GPU போர்டுகளின் வழக்கமான ~50 மில்லிமீட்டர்களை விட சுமார் 100 மடங்கு நெருக்கமாக உள்ளது. அந்த அருகாமையானது போர்டு-லெவல் மின் இழப்பை கிட்டத்தட்ட நீக்குகிறது மற்றும் இரண்டு மடங்கு அதிக சக்தியை செதில் அடைய அனுமதிக்கிறது, வேகமான டோக்கன் உருவாக்கத்திற்குப் பின்னால் அதிக இயக்க அதிர்வெண்களை செயல்படுத்துகிறது.

நெக்ஸஸ் ரேக் கட்டிடக்கலை

சிப்புக்கு அப்பால், CS-4 ஆனது செரிப்ராஸ் Nexus Platform Architecture என்று அழைப்பதை அறிமுகப்படுத்துகிறது, அதன் முதல் உண்மையான ரேக் அளவிலான வடிவமைப்பு மற்றும் என்விடியாவின் NVL72 மற்றும் AMD இன் ஹீலியோஸ் ரேக் அமைப்புகளுக்கு நேரடி பதில். ஒவ்வொரு CS-4 ஆனது மூன்று WSE-3T செயலிகளை தன்னகத்தே கொண்ட "வேஃபர்-ஸ்கேல் பேக்பேக்குகளில்" வைக்கலாம் - 3D பேக்கேஜ்கள், செதில், சக்தி மாற்றம், நேரடி திரவ குளிர்ச்சி, அதிவேக I/O மற்றும் 50% குறைவான கூறுகளுடன் ஒரே அசெம்பிளியில் எலக்ட்ரானிக்ஸ் கட்டுப்படுத்தும்.

மட்டு வடிவமைப்பு நிலையான சக்தி, குளிரூட்டல் மற்றும் பிணைய அடுக்கு ஆகியவற்றை கம்ப்யூட்டிலிருந்து பிரிக்கிறது. ஒரு செரிப்ராஸ் பவர்ராக் நிறுவப்பட்டு, எந்த ஒரு கம்ப்யூட் வருவதற்கு முன்பும் வசதி-தகுதியைப் பெறலாம், மேலும் பேக்பேக்குகள் அதன் இடத்தில் சரியலாம் - வரிசைப்படுத்தல் நேரத்தை நாட்கள் முதல் மணிநேரம் வரை குறைக்கும் என்று நிறுவனம் தெரிவித்துள்ளது.

மின் நுகர்வு கணிசமாக உள்ளது. ஒரு பேக் பேக்கிற்கு சுமார் 46 கிலோவாட் மற்றும் மொத்த சிஸ்டம் டிரா 120 முதல் 140 கிலோவாட் வரை இருக்கும் என்று பதிவேடு மதிப்பிடுகிறது - இருப்பினும் 240 முதல் 250 கிலோவாட் ரேக் சிஸ்டம்களான AMD மற்றும் Nvidia க்கு அடுத்தபடியாக பழமைவாதமாக இருக்கும் கண்களைக் கவரும் எண்கள் இந்த ஆண்டின் இறுதியில் அனுப்பப்படும் என்று எதிர்பார்க்கப்படுகிறது.

கில்லிங் தி ஸ்விட்ச்

ஒருவேளை தொழில்நுட்ப ரீதியாக மிகவும் சுவாரஸ்யமான தேர்வு ஒன்றோடொன்று இணைக்கப்பட்டுள்ளது. சுவிட்சுகள் மூலம் வேஃபர்-டு-வேஃபர் போக்குவரத்தை ரூட் செய்வதற்குப் பதிலாக - AWS அதன் Trainium3 முடுக்கிகளுக்காக பின்பற்றப்பட்ட அணுகுமுறை - செரிப்ராஸ் அதன் சில்லுகளை 2D டோரஸ் டோபாலஜியில் இணைக்கிறது, அங்கு அண்டை செதில்கள் ஒருவருக்கொருவர் நேரடியாகப் பேசுகின்றன. வடிவமைப்பு செதில்-க்கு-வேஃபர் தாமதத்தை ஐந்து மைக்ரோ விநாடிகளிலிருந்து இரண்டாகக் குறைக்கிறது, மேலும் செரிப்ராஸ் மெஷ் 50 டிரில்லியன் அளவுருக்கள் வரையிலான மாதிரிகளை ஆதரிக்க முடியும் என்று கூறுகிறது, இது தற்போது உள்ள எதையும் தாண்டி வசதியாக உள்ளது.

வேக முடிவுகள் வியக்க வைக்கின்றன. ஒரு ஒற்றை CS-4 அமைப்பில், தரப்படுத்தல் நிறுவனமான செயற்கை பகுப்பாய்வு gpt-oss-120b இல் ஒரு பயனருக்கு வினாடிக்கு 4,400 டோக்கன்கள் வரை அளவிடப்படுகிறது - இன்று கிடைக்கும் வேகமான GPU அடிப்படையிலான அனுமான சேவைகளில் வினாடிக்கு சுமார் 12 மடங்கு ~350 டோக்கன்கள். 10 டிரில்லியன் அளவுருக்களுக்கு மேல் உள்ள மாடல்களில் வினாடிக்கு 1,000 டோக்கன்களுக்கு மேல் இந்த அமைப்பு நிலைத்திருப்பதாக செரிப்ராஸ் கூறுகிறது.

ஒரு பிரிக்கப்பட்ட கூட்டாண்மை உத்தி

குறிப்பிடத்தக்க வகையில், செரிப்ராஸ் இனி தனது சொந்த சிலிக்கானில் முழு அனுமான பைப்லைனையும் இயக்க முயற்சிக்கவில்லை. நிறுவனம் AWS மற்றும் AMD உடன் கூட்டு சேர்ந்து முறையே Trainium XPUகள் மற்றும் Instinct GPUகள் மீது கணிப்பு-தீவிர உடனடி-செயலாக்க நிலைகளை ஏற்றி, அதன் வேஃபர்-அளவிலான இயந்திரங்களை அவற்றின் பாரிய SRAM இருப்புக்கள் பளபளக்கும் லேட்டன்சி-சென்சிட்டிவ் டிகோட் கட்டத்தை கையாள விட்டு.

CS-4 வெளியீடு, OpenAI உடனான செரிப்ராஸின் ஒத்துழைப்பை விரிவுபடுத்துகிறது. AI அனுமானத்தை விரைவுபடுத்தும் நோக்கில் புதிய OpenAI மற்றும் AMD பார்ட்னர்ஷிப்களுடன் இணைந்து வெளியிட்டதாக Yahoo Finance அறிவித்தது - ஆகஸ்ட் மாதம் முன்னதாக அறிமுகப்படுத்தப்பட்ட நிறுவனங்கள் Ultrafast பயன்முறையை உருவாக்கியது, இது GPT-5.6 Sol ஐ வினாடிக்கு 750 டோக்கன்கள் வரை பயனர்களுக்குக் கொண்டு வந்தது.

தலைப்பு எண்களுக்குப் பின்னால் உள்ள எச்சரிக்கைகள்

தொழில்துறை ஆய்வாளர்கள் சந்தைப்படுத்தல் புள்ளிவிவரங்களில் சில எச்சரிக்கையை வலியுறுத்துகின்றனர். செரிப்ராஸின் தலைப்பு 250 பெட்டாஃப்ளோப்ஸ் ஸ்பார்சிட்டியை நம்பியுள்ளது, இது பொதுவாக பெரிய மொழி மாதிரி அனுமானத்திற்கு பயனளிக்காது, மேலும் WSE-3 அதன் சொந்த SRAM ஐ நிறைவு செய்வதற்கான கணக்கீடு இல்லாததால் உச்ச நினைவக அலைவரிசை புள்ளிவிவரங்கள் பெரும்பாலும் தத்துவார்த்தமாக உள்ளன என்று பதிவு குறிப்பிடுகிறது. SRAM திறனை அதிகரிப்பதற்குப் பதிலாக செரிப்ராஸ் ஏன் செயல்திறனை இரட்டிப்பாக்கியது என்றும் அந்த வெளியீடு கேள்வி எழுப்பியது, இது ஐந்து ஆண்டுகளுக்கு முன்பு WSE-2 தொடங்கப்பட்டதிலிருந்து அர்த்தமுள்ளதாக வளரவில்லை - டிகோட் முடுக்கிகள் நினைவகத்திலிருந்து மிகவும் பயனடையும் ஒரு பிரிக்கப்பட்ட அனுமானத்தின் சகாப்தத்தில் ஒரு ஆர்வமுள்ள தேர்வு.

இருப்பினும், சந்தை வாய்ப்பு உண்மையானது. AI சாட்போட்கள் மற்றும் முகவர்கள் எப்போதும் வேகமான மறுமொழி நேரத்தைக் கோருவதால், அனுமான வேகம் ஒரு உண்மையான போட்டி வேறுபடுத்தியாக மாறியுள்ளது, மேலும் செரிப்ராஸ் இப்போது அதன் வழக்கத்திற்கு மாறான செதில் அளவிலான தொழில்நுட்பத்தை வணிக ரீதியாக மாற்றியமைக்க முடியும் என்பதை நிரூபித்துள்ளது.

முதல் CS-4 ஏற்றுமதிகள் இந்த காலாண்டில் தொடங்குகின்றன, முதல் அமைப்புகள் செப்டம்பர் இறுதிக்குள் ஆன்லைனில் எதிர்பார்க்கப்படுகின்றன. என்விடியாவின் ஆதிக்கத்தைத் தணிக்க இது போதுமானதா என்பதைப் பார்க்க வேண்டும் - ஆனால் சிறிது நேரத்தில் முதல் முறையாக, தொழில்துறையில் வேகமான AI அனுமானம் ஒரு புதிய முகவரியைக் கொண்டுள்ளது.

AIக்கு முன்னால் இருங்கள்

CS-4 நகர்வு சந்தைகள் மற்றும் AI அமைப்புகள் என்ன செய்ய முடியும் என்பதை மறுவரையறை செய்வது போன்ற வன்பொருள் வெளியீடுகள். மேலும் AI செய்திகளைப் படிக்கவும் ஒவ்வொரு வளர்ச்சியையும் தொடர.

சமீபத்திய AI கவரேஜை ஆராயுங்கள் →