அமேசான் வெப் சர்வீசஸ், Zhipu AI என்றும் அழைக்கப்படும் மாடல் டெவலப்பரான Z.ai இலிருந்து Amazon Bedrock க்கு GLM 5.3 ஐச் சேர்த்துள்ளது, இது நிறுவன வாடிக்கையாளர்களுக்கு இந்த ஆண்டு வெளியிடப்பட்ட மிகப்பெரிய திறந்த எடை மாடல்களில் ஒன்றான API அணுகலை முழுமையாக நிர்வகிக்கிறது. அக்டோபர் 5 அன்று AWS மெஷின் லேர்னிங் வலைப்பதிவில் அறிவிக்கப்பட்ட இந்த வெளியீடு, 753B-அளவுரு கலவை-நிபுணர்களின் மாதிரியை பெட்ராக்கின் நிர்வகிக்கப்பட்ட உள்கட்டமைப்பு மூலம் கிடைக்கச் செய்கிறது.
AWS இன் படி, GLM 5.3 - ஹக்கிங் ஃபேஸ் ஹப்பில் வெளியிடப்பட்டது - குறியீட்டு மற்றும் நீண்ட-அடிவான முகவர் பணிகளுக்கு உகந்ததாக உள்ளது, Z.ai குறிப்பிடத்தக்க சைபர் பாதுகாப்பு திறன்களைப் புகாரளிக்கிறது. நிறுவன வாங்குபவர்கள் இந்த ஆண்டு எல்லை API களில் இருந்து வெளியேறியதை அந்த பலம் நேரடியாக வரைபடமாக்குகிறது: பல-படி பகுத்தறிவு, கருவி-ஆக்மென்டட் பணிப்பாய்வு மற்றும் பெரிய குறியீடு அடிப்படைகள் முழுவதும் நீடித்த சூழல். For more context on this story, see our ongoing AI industry coverage.
பெட்ராக் வாடிக்கையாளர்களுக்கு உண்மையில் என்ன கிடைக்கும்
இந்த ஒருங்கிணைப்பு பெட்ராக்கின் நிலையான நிர்வகிக்கப்பட்ட அணுகல் பிளேபுக்கைப் பின்பற்றுகிறது, சில நிறுவன தர கூடுதல் அம்சங்களுடன்:
- Flexible API அணுகல். GLM 5.3 ஆனது OpenAI-இணக்கமான பதில்கள் மற்றும் Chat Completions APIகள் மூலம் செயல்படுத்தப்படலாம் - இது AWS புதிய பயன்பாடுகளுக்கு பரிந்துரைக்கிறது - அத்துடன் சொந்த Bedrock Invoke மற்றும் Converse APIகள் மூலமாகவும். தற்போதுள்ள OpenAI-அடிப்படையிலான பைப்லைன்களை நகர்த்தும் குழுக்கள், குறைந்தபட்ச குறியீடு மாற்றங்களுடன் மாதிரியை மறுபரிசீலனை செய்யலாம்.
- குறுக்கு-மண்டல அனுமானம். இரண்டு அனுமான சுயவிவரங்களுக்குப் பின்னால் உள்ள மாதிரி அனுப்பப்படுகிறது, US குறுக்கு பிராந்திய போக்குவரத்திற்கு us.zai.glm-5.3 மற்றும் உலகளாவிய ரூட்டிங்கிற்கான உலகளாவிய.zai.glm-5.3. கோரிக்கைகள் வாடிக்கையாளரின் விருப்பத்தின் மூலப் பகுதிக்குச் செல்கின்றன, மேலும் Bedrock பாதுகாப்பான ரூட்டிங்கைக் கையாளுகிறது.
- உடனடியான கேச்சிங். வெளிப்படையான கேச் கட்டுப்பாடுகள் OpenAI-இணக்கமான APIகளில் கிடைக்கும். ஒவ்வொரு திருப்பத்திலும் பெரிய கணினி தூண்டுதல்கள் அல்லது களஞ்சிய சூழலை மீண்டும் அனுப்பும் முகவர் பணிச்சுமைகளுக்கு, கேச்சிங் தாமதம் மற்றும் உள்ளீட்டு செலவு இரண்டையும் குறைக்கிறது என்று AWS கூறுகிறது.
- சேவை அடுக்குகள். வாடிக்கையாளர்கள் செலவு-உகந்த, குறைவான நேரத்தை உணர்திறன் கொண்ட பணிச்சுமைகளுக்கு ஃப்ளெக்ஸைத் தேர்வு செய்யலாம், பிரீமியத்தில் தாமதம்-முக்கியமான போக்குவரத்திற்கு முன்னுரிமை அல்லது இயல்புநிலை இருப்புக்கான தரநிலை.
ஒரு எச்சரிக்கை தனித்து நிற்கிறது: AWS ஆனது Bedrock இல் GLM 5.3க்கான அணுகல் தகுதியுள்ள நிறுவன வாடிக்கையாளர்களுக்குக் கிடைக்கும் என்று கூறுகிறது, இது அனைத்து கணக்குகளுக்கும் சுய சேவையைத் திறப்பதற்குப் பதிலாக ஒரு நுழைவுச் செயல்முறையைப் பரிந்துரைக்கிறது.
சீன ஆய்வகத்திற்கு முதலில் வருவாய் பகிர்வு
தொழில்நுட்ப ஒருங்கிணைப்புக்கு அப்பால், வெளியீட்டின் பத்திரிகை கவரேஜ் AWS மற்றும் Z.ai இடையே ஒரு பயன்பாட்டு அடிப்படையிலான வருவாய்-பகிர்வு ஏற்பாட்டை விவரிக்கிறது, இதன் கீழ் மாடல் வழங்குநர் பெட்ராக் நுகர்வு குறைப்பைப் பெறுகிறார் - நிலையான வணிக டெம்ப்ளேட் பெட்ராக் மேற்கத்திய கூட்டாளர்களுடன் பயன்படுத்துகிறது, இது இப்போது எல்லை சீன ஆய்வகத்தின் முதன்மை மாதிரிக்கு பயன்படுத்தப்படுகிறது. ஹாங்காங் சந்தைகள் பற்றிய நிதி பத்திரிகை அறிக்கை, செய்தியின் ஆரம்ப வர்த்தகத்தில் Zhipu தொடர்பான பங்குகள் 7% க்கும் அதிகமாக உயர்ந்தன.
பிளாட்ஃபார்ம் மூலோபாயத்தைப் பற்றி என்ன சமிக்ஞை செய்கிறது என்பதற்கு ஒப்பந்தம் முக்கியமானது. ஹைப்பர்ஸ்கேலர்கள் கடந்த இரண்டு ஆண்டுகளாக மேற்கத்திய ஆய்வகங்களுடன் பிரத்தியேக-உணர்வு கூட்டணியில் பூட்டினர்; சீன திறந்த-எடைக் குடும்பத்திற்கு பெட்ராக்கைத் திறப்பது, செலவு உணர்திறன் கொண்ட நிறுவனங்களுக்கும், அமெரிக்க மாடல்கள் விலை அழுத்தத்தை எதிர்கொள்ளும் சந்தைகளுக்கும் தளத்தின் வரம்பை விரிவுபடுத்துகிறது. இது Z.ai விநியோகத்தையும் வழங்குகிறது, எந்த ஓப்பன்-வெயிட் வெளியீட்டையும் பொருத்த முடியாது: 753B-அளவுரு சோதனைச் சாவடியைப் பதிவிறக்காத ஆயிரக்கணக்கான நிறுவனங்கள் இப்போது அதை SLAக்குப் பின்னால் அழைக்கலாம்.
திறந்த எடையிலிருந்து நிர்வகிக்கப்பட்ட API வரை
பெட்ராக்கிற்கு GLM 5.3 இன் பாதை திறந்த எடை சமூகத்தின் வழியாக ஓடியது. இந்த மாதிரி ஹக்கிங் ஃபேஸ் ஹப்பில் வெளியிடப்பட்டது, அதன் எடைகள், வரையறைகள் மற்றும் உரிம விதிமுறைகள், நிர்வகிக்கப்பட்ட ஹோஸ்டிங் வழங்கப்படுவதற்கு முன்பே டெவலப்பர்களின் கவனத்தை ஈர்த்தது - ஜிஎல்எம் தொடரில் Z.ai என்ற பிளேபுக் பயன்படுத்தப்பட்டது, இதில் MIT-உரிமம் பெற்ற GLM-5.3-Flash வெளியீடு சீனத் தயாரிக்கப்பட்ட சிப்களில் இயங்கியது.
நிறுவனங்களைப் பொறுத்தவரை, எடைகளைப் பதிவிறக்குவதற்கும் API ஐ அழைப்பதற்கும் இடையிலான கால்குலஸ் எப்போதுமே செயல்பாட்டிற்கு வந்துள்ளது: 753B-அளவுரு கலவை-நிபுணர்களின் மாதிரியை சுய-ஹோஸ்ட் செய்வது தீவிர GPU திறன் மற்றும் MLOps முதிர்ச்சியைக் கோருகிறது, பெரும்பாலான நிறுவனங்கள் ஒரு பணிச்சுமையை நியாயப்படுத்த முடியாது. பெட்ராக்கின் நிர்வகிக்கப்பட்ட அணுகல், டேட்டா-ரெசிடென்சி கட்டுப்பாடுகள் உள்ள நிறுவனங்களுக்கு ஹைப்ரிட் வரிசைப்படுத்தல் விருப்பத்தைத் திறந்து வைத்திருக்கும் அதே வேளையில் அந்தத் தடையை நீக்குகிறது.
தொடங்குதல், உறுதியாக
AWS இன் ஆவணங்கள் பெட்ராக் கன்சோலில் இருந்து அழைப்புகள் மூலம் நடக்கின்றன - அங்கு மாதிரியானது நிலையான விளையாட்டு மைதானத்தில் எந்த குறியீடும் தேவையில்லாமல் உடனடி சோதனைக்காக தோன்றும் - மற்றும் திட்டவட்டமாக பெட்ராக்-ரன்டைம் எண்ட்பாயிண்ட் மூலம். முன்நிபந்தனைகள் மாதிரி அழைப்பிற்கான வழக்கமான IAM அனுமதிகள் ஆகும், இதில் அடிப்பாறை:InvokeModel மற்றும் அடிப்பாறை:InvokeModelWithResponseStream ஆகியவை அடங்கும், மேலும் தேர்ந்தெடுக்கப்பட்ட குறுக்கு மண்டல அனுமான சுயவிவரத்திற்கான அனுமதிகள். குறியீடு எடுத்துக்காட்டுகளுக்கு பைதான் 3.10 அல்லது அதற்குப் பிறகு பட்டியலிடப்பட்டுள்ளது.
குறிப்பிடத்தக்க வகையில், AWS இடுகையானது, டோக்கர் மற்றும் ஓப்பன் சோர்ஸ் ஸ்ட்ரிக்ஸ் கருவியுடன் கட்டமைக்கப்பட்ட ஒரு விருப்பமான பாதுகாப்பு-சோதனை டெமோவை உள்ளடக்கியது, தாக்குதல்-பாதுகாப்பு பணிப்பாய்வுகளுக்காக GLM 5.3 ஐ பெட்ராக் வழியாக இயக்குகிறது - இது Z.ai மாடலுக்காக கோரியுள்ள சைபர் செக்யூரிட்டி நிலைப்படுத்தலை அடிக்கோடிட்டுக் காட்டுகிறது. AWS போன்ற இணக்க உணர்திறன் கொண்ட ஒரு தளத்திற்கு, ஹேக்கிங்-டெமோ சூழலில் சீன மாடலைக் காண்பிப்பது Z.ai துரத்துகின்ற பணிச்சுமை கலவையைப் பற்றிய ஒரு குறிப்பான சமிக்ஞையாகும்.
நிபுணர்களின் கலவையான பொருளாதாரம்
753B-அளவுரு உருவம் அதன் கட்டிடக்கலையை விட அதன் அளவு குறைவாக உள்ளது. நிபுணர்களின் கலவை மாதிரிகள் ஒரு டோக்கனுக்கு அவற்றின் அளவுருக்களில் ஒரு பகுதியை மட்டுமே செயல்படுத்துகின்றன, இதுவே GLM 5.3 ஒவ்வொரு கோரிக்கையிலும் எல்லை அளவிலான அனுமான செலவுகள் இல்லாமல் எல்லை அளவிலான திறனை வழங்க முடியும். ப்ராம்ட் கேச்சிங்குடன் இணைந்து - மீண்டும் மீண்டும் கணினி தூண்டுதல்கள் மற்றும் களஞ்சிய சூழல் தற்காலிக சேமிப்பிலிருந்து குறைந்த செலவில் வழங்கப்படுகின்றன - பொருளாதாரம் இந்த ஆண்டு நிறுவன AI வரவு செலவுத் திட்டங்களில் ஆதிக்கம் செலுத்தும் அதிக அளவிலான ஏஜென்டிக் பணிச்சுமைகளை இலக்காகக் கொண்டுள்ளது: குறியீட்டு உதவியாளர்கள், பாதுகாப்பு செயல்பாடுகள் மற்றும் நீண்டகால ஆட்டோமேஷன் பைப்லைன்கள்.
பெட்ராக்கின் சேவை அடுக்குகள் பின்னர் செயல்பாட்டுக் குழுக்களை ஒரு பணிச்சுமைக்கான தாமதத்திற்கு எதிராக வர்த்தகம் செய்ய அனுமதிக்கின்றன. ஒரு இரவுத் தொகுதி குறியீடு-பகுப்பாய்வு வேலை ஃப்ளெக்ஸ் விலையில் இயங்கும், அதே நேரத்தில் ஒரு ஊடாடும் பாதுகாப்பு கோபிலட் முன்னுரிமை அடுக்கில் சவாரி செய்கிறது - அதே மாதிரி, வித்தியாசமாக அளவிடப்படுகிறது.
என்ன பார்க்க வேண்டும்
ஏவுதல் மூன்று நெருங்கிய கால சோதனைகளை அமைக்கிறது. முதலில், தத்தெடுப்பு: பெட்ராக்கின் நிறுவனத் தளம் GLM 5.3 ஐ ஒரு உற்பத்தி விருப்பமாக கருதுகிறதா அல்லது தரப்படுத்தல் ஆர்வமாக இருக்கிறதா. இரண்டாவதாக, விலை நிர்ணயம்: ஃப்ளெக்ஸ் அடுக்கு தாமதம்-உகந்த சேவை நிலைகளைக் குறைக்கிறது, மேலும் GLM-தொடர் விலை நிர்ணயம் வரலாற்று ரீதியாக மேற்கத்திய போட்டியாளர்களுக்கு செலவில் அழுத்தம் கொடுத்துள்ளது. மூன்றாவதாக, பதில்: பிற ஹைப்பர்ஸ்கேலர்கள் சீன மாதிரி நிறுவனப் பிரிவை ஹோஸ்டிங் அல்லது விட்டுக்கொடுப்பதற்கான அதே தேர்வை எதிர்கொள்கின்றனர்.
AI குழுக்கள் மாதிரி கிடைப்பதைக் கண்காணிக்கும் நடைமுறை எளிதானது - 2026 இல் மிகவும் உன்னிப்பாகக் கவனிக்கப்பட்ட ஓப்பன் வெயிட் மாடல்களில் ஒன்று AWS வாடிக்கையாளர்களுக்கு இப்போது ஒரு API அழைப்பு தொலைவில் உள்ளது, மேலும் AI மாதிரிகள் நிலப்பரப்பு சீன ஆய்வகத்தில் கையெழுத்திடும் ஒவ்வொரு தளத்திலும் மிகவும் போட்டித்தன்மையுடன் வளர்கிறது.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →