ஆகஸ்ட் 20 அன்று OpenRouter மற்றும் OpenCode இல் தோன்றியதில் இருந்து டெவலப்பர் உரையாடல்களில் ஆதிக்கம் செலுத்திய பிராண்ட் செய்யப்படாத AI மாதிரியான Ox Alpha இன் அடையாளம் இனி மர்மமாக இல்லை. சீனாவின் Z.AI புதனன்று ப்ளூம்பெர்க் நியூஸிடம் இந்த மாடல் அதன் GLM தொடரின் புதிய மறு செய்கை என்று உறுதிப்படுத்தியது - மேலும் இந்த மாடலின் எடையை இன்றிரவு வெளியிடுவதாகவும், எவரும் பதிவிறக்கம் செய்து இயக்குவதற்கு அவற்றைக் கிடைக்கும் என்றும் கூறியது.
இந்த உறுதிப்படுத்தல் AI சமூகம் இந்த ஆண்டு பார்த்த மிகவும் வெறித்தனமான யூகிக்கும் கேம்களில் ஒன்றாகும், மேலும் இது மேற்கத்திய ஆய்வகங்களுடனான மோதல் போக்கில் முதன்மை தர சீன மாடலை வைக்கிறது, இது ஒப்பிடக்கூடிய திறன்களை செங்குத்தான பிரீமியத்தில் விலை நிர்ணயம் செய்கிறது. For more context on this story, see our ongoing breaking AI news.
ஒரு திருட்டுத்தனமான ஏவுதல் வடிவமைக்கப்பட்டது போலவே வேலை செய்தது
ஆக்ஸ் ஆல்பா ஒரு பட்டியலுடன் வந்தார், அது என்ன செய்ய முடியும் மற்றும் யார் கட்டியது என்பது பற்றி எதுவும் விவரிக்கப்படவில்லை. OpenRouter அதை "இந்த மாதிரிக்காட்சியின் போது அநாமதேயமாக இருக்கத் தேர்ந்தெடுத்த மூன்றாம் தரப்பு வழங்குநர்" என்று கூறியது, மேலும் குறியீட்டு முறை, நீடித்த ஏஜென்டிக் வேலை மற்றும் உற்பத்திப் பணிச்சுமைகளுக்காக உருவாக்கப்பட்ட ஒரு நியாயமான மாதிரியாக அதை நிலைநிறுத்தியது.
குறிப்புகள் மட்டுமே தலையை மாற்ற போதுமானதாக இருந்தது: ஒரு மில்லியனுக்கும் அதிகமான டோக்கன்களின் சூழல் சாளரம், உரை, படம் மற்றும் வீடியோ உள்ளீட்டிற்கான ஆதரவு மற்றும் OpenRouter மற்றும் OpenCode இரண்டிலும் முற்றிலும் இலவச அணுகல். ஓபன்கோட் மாடலுக்காக ஒரு நாளைக்கு 100 டிரில்லியன் டோக்கன்களின் சேவைத் திறனை விளம்பரப்படுத்தியது, மேலும் நௌஸ் ரிசர்ச் அதன் சொந்த போர்ட்டல் ஒரு குவாட்ரில்லியன் டோக்கன்களைத் தள்ள முடியும் என்று கூறியது.
நடுநிலை உள்கட்டமைப்பில் அநாமதேயமாக ஒரு எல்லைக்கு அருகில் உள்ள மாதிரியை இயக்குவதன் மூலம், Z.AI அதன் பிராண்டை இணைக்கும் முன் உண்மையான பயன்பாட்டுத் தரவு மற்றும் வடிகட்டப்படாத பெஞ்ச்மார்க் உரையாடலைச் சேகரிக்க அனுமதிக்கும் - ஒவ்வொரு திறந்த-எடை சீன வெளியீட்டைத் தொடர்ந்து வரும் தள்ளுபடி விவரிப்புகளைத் தடுக்கும் ஒரு பிளேபுக், வெளியீட்டின் பகுப்பாய்வில் OfficeChai குறிப்பிட்டது.
உருகியை ஏற்றிய பெஞ்ச்மார்க் ரன்
வெறியானது ஒரு தரவுப் புள்ளியில் பின்னோக்கிச் செல்கிறது. வெளியான ஒரு நாளுக்குள், டெவலப்பர் பென் டேவிஸ், DeepSWE அளவுகோலில் முறைசாரா பத்து-பணி மதிப்பீட்டை நடத்தி, ஆக்ஸ் ஆல்பாவிற்கு 80 சதவீத முதல்-பாஸ் துல்லியத்தை அறிவித்தார் - கிளாட் ஃபேபிள் 5 ஐ விட 65 சதவீதம் மற்றும் GPT-5.6 சோல் 52 சதவீதம்.
அந்த முடிவு மாடலை வைரலாக அனுப்புவதற்கும், ஓபன்கோட் லீடர்போர்டில் டீப்சீக்கின் 56-நாள் தொடரை முடிக்கவும் போதுமானதாக இருந்தது. இது உடனடி தள்ளாட்டத்தையும் ஈர்த்தது. ப்ளூம்பெர்க்கின் உறுதிப்படுத்தல் நூற்றுக்கணக்கான கருத்துக்களைக் குவித்த ஹேக்கர் நியூஸில், டெவலப்பர்கள் எச்சரிக்கையாக இருக்க வேண்டும் என்று வலியுறுத்தியுள்ளனர், பத்து-பணி ஓட்டம் என்பது எதையும் தீர்க்க மிகவும் சிறிய மாதிரி மற்றும் பிற லீடர்போர்டுகளில் மாதிரியின் முடிவுகள் குறிப்பிடத்தக்க வகையில் மிகவும் கலவையாக இருந்தன.
இணையம் எப்படி வழக்கை முதலில் முறியடித்தது
புதன்கிழமை உறுதிப்படுத்தப்படுவதற்கு நீண்ட காலத்திற்கு முன்பே, சமூக துப்பறியும் பணி ஏற்கனவே Z.AI இல் நிலைபெற்றிருந்தது - முன்பு Zhipu AI என அறியப்பட்டது - முன்னணி வேட்பாளராக இருந்தது. "dax" மூலம் செல்லும் டெவலப்பர் 25 ப்ராம்ப்ட்களில் டோக்கனைசர் கைரேகை சோதனையை நடத்தினார், மேலும் ஆக்ஸ் ஆல்பாவின் மூல டோக்கன் எண்ணிக்கைகள் 11 ஆய்வுகளில் 11 இல் GLM இன் டோக்கனைசருடன் பொருந்தியிருப்பதைக் கண்டறிந்தார், அதே நேரத்தில் வேறு எந்த ஆய்வகத்தின் மாதிரியும் நான்கை அழிக்கவில்லை. ஒரு இலக்க ஆய்வில், டீப்சீக்கின் டோக்கனைசர் 98 டோக்கன்களை எரித்தது, அங்கு GLM 29 பயன்படுத்தியது.
ஆக்ஸ் ஆல்பா அதே "அழுக்கு டோக்கனில்" தடுமாறியது என்று தனி பகுப்பாய்வு கண்டறிந்தது, இது வரலாற்று ரீதியாக க்வென் மற்றும் ஜிஎல்எம்-குடும்ப மாதிரிகளை முறியடித்தது, ஆரம்பத்தில் சீன ஆய்வகமாக களத்தை சுருக்கியது. மற்ற முக்கிய கோட்பாடு - Xiaomi, அதன் MiMo குழு முன்பு MiMo-V2-Pro உடன் ஒரே மாதிரியான ஸ்டெல்த்-லான்ச் பிளேபுக்கை ஹண்டர் ஆல்பா என்ற பெயரில் இயக்கியது - இப்போது ஒரு ஏமாற்று வேலையாகத் தெரிகிறது.
வெளிப்பாட்டின் பங்குகள் தற்பெருமை உரிமைகளுக்கு அப்பாற்பட்டவை. செவ்வாயன்று நியூ யோர்க் டைம்ஸ், சீன ஆய்வகத்தின் மாதிரி வெளியீடு உலகின் இணையப் பாதுகாப்புத் தயார்நிலையைச் சோதிக்கக்கூடும் என்று தெரிவித்தது, மேற்கத்திய அரசாங்கங்கள் இந்த திறனுடைய திறந்த-எடை வெளியீடுகளை எவ்வளவு உன்னிப்பாகக் கவனிக்கின்றன என்பதை அடிக்கோடிட்டுக் காட்டுகிறது.
திறந்த எடைகள் ஏன் கால்குலஸை மாற்றுகின்றன
இன்றிரவு எடைகள் வரும் என்பதை Z.AI இன் உறுதிப்படுத்தல் சந்தைக்கு முக்கியமான பகுதியாகும். நிறுவனத்தின் தற்போதைய GLM 5.3 ஆனது அதன் முதல் தரப்பு API இல் ஒரு மில்லியன் உள்ளீட்டு டோக்கன்களுக்கு $1.40 மற்றும் ஒரு மில்லியன் வெளியீட்டு டோக்கன்களுக்கு $4.40 விலையில் 81 சதவீத கேச் தள்ளுபடியுடன் உள்ளது. OfficeChai படி, GLM 5 முதல் Z.AI பயன்படுத்திய அதே MIT உரிமத்தின் கீழ் புதிய மாடல் அனுப்பப்படும் என்று எதிர்பார்க்கப்படுகிறது.
மேற்கத்திய API விலை நிர்ணயத்தின் ஒரு பகுதியிலேயே வெளிப்படையாக வெளியிடப்பட்ட எல்லைப்புற-அருகிலுள்ள குறியீட்டு முறை மற்றும் முகவர் செயல்திறன், துல்லியமாக பிரீமியம் ஆய்வகங்கள் தவிர்க்க முயற்சி செய்து இரண்டு வருடங்கள் செலவழித்த அழுத்த புள்ளியாகும். இது சீன சந்தையில் டீப்சீக்குடன் Z.AIக்கு போட்டியாக உள்ளது, அங்கு இலவசமாக தரவிறக்கம் செய்யக்கூடிய மாடல்கள், ஆய்வகத்தின் முழுமையான எல்லைக்கு குறைவான எதற்கும் இயல்புநிலை எதிர்பார்ப்பாக மாறியுள்ளது.
அடுத்து என்ன பார்க்க வேண்டும்
முக்கிய விவரங்கள் உறுதிப்படுத்தப்படாமல் உள்ளன - மிக முக்கியமாக அளவுரு எண்ணிக்கை மற்றும் மாதிரி அளவு, இது உள்ளூர் வரிசைப்படுத்தலுக்கு வெளியீடு எவ்வளவு நடைமுறைக்குரியது என்பதை தீர்மானிக்கும். மாடல் அளவுமயமாக்கலுக்கு எவ்வாறு பதிலளிக்கிறது மற்றும் தரவு மைய ஜிபியுக்களை விட நுகர்வோர் வன்பொருளில் எவ்வளவு வேகமாக இயங்குகிறது என்பதில் சமூக விவாதம் ஏற்கனவே பூஜ்ஜியமாக உள்ளது.
ஒரு வாரம் அநாமதேய ஊகங்கள் Z.AI க்கு எந்த மார்க்கெட்டிங் பட்ஜெட்டையும் வாங்க முடியாது என்பது உறுதியானது: நடுநிலை அடிப்படையில் பாரபட்சமற்ற, பிராண்ட்-அஞ்ஞானச் சரிபார்ப்பு. இப்போது மாடலுக்கு ஒரு பெயர் இருப்பதால், அளவுகோல்கள் இன்னும் நிறைய நெரிசலைப் பெற உள்ளன - மேலும் மிகவும் கடுமையானவை.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →