युनायटेड स्टेट्स आणि युनायटेड किंगडम सरकारच्या AI सुरक्षा संस्थांनी केलेल्या संयुक्त प्राथमिक मूल्यांकनाने असा निष्कर्ष काढला आहे की Moonshot AI चे ओपन-वेट किमी K3 मॉडेल आक्षेपार्ह सायबर टास्कमध्ये मोठ्या फरकाने यूएस फ्रंटियर मॉडेल्सच्या मागे आहे. 25 जुलै 2026 रोजी प्रकाशित झालेला शोध, युनायटेड स्टेट्समध्ये दत्तक घेत असताना चिनी-विकसित AI प्रणालींशी कसे वागले पाहिजे यावरील तीव्र चर्चेला एक ठोस डेटा पॉइंट जोडतो.
यूकेच्या AISI सह CAISI म्हणून ओळखल्या जाणाऱ्या NIST येथे असलेल्या US AI सुरक्षा संस्थेने हे मूल्यांकन प्रसिद्ध केले आहे. हे विशेषत: सायबर डोमेनवर केंद्रित असलेल्या Kimi K3 च्या पहिल्या अधिकृत पाश्चात्य मूल्यमापनांपैकी एक आहे. ब्रेकिंग एआय न्यूज च्या जलद गतीने जाणाऱ्या लँडस्केपचे अनुसरण करणाऱ्या वाचकांसाठी, कोणत्याही एका बेंचमार्क स्कोअरसाठी हा परिणाम कमी लक्षणीय आहे, जे सरकारी प्रयोगशाळा आता परदेशी मॉडेल्स मोठ्या प्रमाणावर लागू होण्याआधी तपासण्यामध्ये खेळत असलेल्या विस्तारित भूमिकेबद्दल सूचित करतात.
काय मूल्यांकन मोजले
बीजिंग-आधारित मूनशॉट AI द्वारे जारी केलेले Kimi K3, हे एक मोठे ओपन-वेट मॉडेल आहे ज्याने लॉन्च केल्यानंतर सशक्त सामान्य-उद्देश कामगिरीसाठी जागतिक लक्ष वेधून घेतले. त्याच्या खुल्या वितरणाचा अर्थ संशोधक आणि विकासक थेट वजन डाउनलोड आणि तपासू शकतात, ज्यामुळे ते बाह्य सुरक्षा चाचणीसाठी एक नैसर्गिक उमेदवार बनले.
नवीन प्राथमिक अहवाल एका संकुचित आणि अधिक संवेदनशील प्रश्नावर लक्ष केंद्रित करतो: आक्षेपार्ह सायबर ऑपरेशन्सचे मॉडेल किती सक्षम आहे, राष्ट्रीय-सुरक्षा एजन्सींसाठी सर्वात महत्त्वाची कामे? किमी K3 चे व्यापक ज्ञान किंवा तर्कावर मूल्यमापन करण्याऐवजी, संस्थांनी तपासले की ते सायबर हल्ले करण्यास, सॉफ्टवेअरच्या असुरक्षिततेचे शोषण करण्यास किंवा दुर्भावनापूर्ण संगणक ऑपरेशन्समध्ये मदत करू शकते का.
संख्या: अंदाजे 32% विरुद्ध 76%
हेडलाइन परिणाम एक तीक्ष्ण अंतर आहे. सायबर-क्षमता मूल्यमापनावर, Kimi K3 ने अंदाजे 32% गुण मिळवले, तर आघाडीचे US फ्रंटियर मॉडेल 76% पर्यंत पोहोचले, असे मूल्यांकनाच्या अहवालानुसार. सोप्या भाषेत भाषांतरित, यूएस संस्थांना असे आढळून आले की चिनी मॉडेल शीर्ष पाश्चात्य मॉडेल हाताळलेल्या आक्षेपार्ह सायबर कार्यांपैकी फक्त एक तृतीयांश कार्य पूर्ण करू शकते.
रिलीझ कव्हर करणाऱ्या एकाधिक आउटलेट्सने सातत्यपूर्ण अंतर तयार केले. साउथ चायना मॉर्निंग पोस्ट ने अहवाल दिला की किमी K3 "सायबर हल्ल्याच्या क्षमतेमध्ये यूएस प्रतिस्पर्ध्यांच्या मागे" बसला आहे, तर इंटरेस्टिंग इंजिनिअरिंग ने सायबर बेंचमार्कवर 76% विरुद्ध 32% प्रसार हायलाइट केला आहे. मूल्यांकन प्राथमिक म्हणून वर्णन केले आहे, याचा अर्थ संस्था सूचित करत आहेत की कोणतेही अंतिम निष्कर्ष काढण्यापूर्वी पुढील चाचणी होण्याची शक्यता आहे.
अंतर का असू शकते
एक मॉडेल जे सामान्य बेंचमार्कवर जोरदार कामगिरी करते परंतु सायबर गुन्ह्यांवर कमकुवतपणे एक मनोरंजक कोडे सादर करते आणि विश्लेषकांनी आधीच वजन करणे सुरू केले आहे. द डीकोडर येथे लिहिताना, भाष्यकारांनी नमूद केले की डिस्टिलेशन विसंगतीचा भाग स्पष्ट करू शकते.
डिस्टिलेशन हे एक प्रशिक्षण तंत्र आहे ज्यामध्ये एक मॉडेल सुरवातीपासून प्रत्येक क्षमता तयार करण्याऐवजी अधिक सक्षम "शिक्षक" मॉडेलच्या आउटपुटचे अनुकरण करून शिकते. जर Kimi K3 अंशतः डिस्टिलेशनद्वारे विकसित केले गेले असेल, तर विश्लेषकांचे म्हणणे आहे की, ते त्याच्या शिक्षक म्हणून काम केलेल्या कोणत्याही मॉडेलद्वारे सेट केलेल्या क्षमतेवर कमाल मर्यादा वारशाने मिळवू शकते, अत्याधुनिक आक्षेपार्ह सायबर ऑपरेशन्स सारख्या कठीण कामांवर संभाव्यत: कार्यक्षमता मर्यादित करते.
ते गृहितक फक्त तेच राहते, एक गृहितक. प्राथमिक अहवाल हे अंतर का अस्तित्वात आहे हे ठरवत नाही, फक्त ते अस्तित्वात आहे. इतर संभाव्य घटकांमध्ये जाणूनबुजून क्षमता निर्बंध, प्रशिक्षण डेटामधील फरक किंवा मॉडेलला मोठ्या प्रमाणावर उपलब्ध हार्डवेअरवर चालविण्यासाठी पुरेसे कार्यक्षम ठेवण्यासाठी केलेले ट्रेड-ऑफ यांचा समावेश होतो.
एक आरोपित राजकीय पार्श्वभूमी
चायनीज एआय सिस्टम्सची छाननी करण्यासाठी यूएसच्या व्यापक दबावाच्या मध्यभागी मूल्यांकन उतरले आहे. जुलैच्या सुरुवातीला, ट्रम्प प्रशासनाने सायबरसुरक्षा चिंतेचा हवाला देऊन अमेरिकेत चिनी-विकसित एआय मॉडेल्सचा वापर प्रतिबंधित करण्याच्या प्रयत्नांना पुनरुज्जीवित केले, त्या चर्चेत किमी के 3 चे वारंवार नाव घेतले गेले. यूएस कायदाकर्त्यांनी अमेरिकन कंपन्यांना त्यांच्या उत्पादनांमध्ये परदेशी मॉडेल्स समाकलित करण्याच्या डेटा-सुरक्षा परिणामांवर स्वतंत्रपणे दबाव आणला आहे.
त्या पार्श्वभूमीवर, सरकारला असे आढळून आले आहे की सर्वात प्रमुख चिनी ओपन-वेट मॉडेल दोन दिशांनी गुन्ह्यांमध्ये कमी कामगिरी करत आहे. निर्बंधांसाठी युक्तिवाद करणाऱ्यांसाठी, हे अधिकृत पुरावे प्रदान करते की मॉडेलची चाचणी घेण्याइतकी गंभीरपणे वागणूक दिली जात आहे. अतिप्रचंडतेपासून सावध असलेल्यांसाठी, तुलनेने कमी सायबर स्कोअर देखील प्रत्येक चिनी मॉडेल तत्काळ सायबर धोक्याचे प्रतिनिधित्व करते हे कथन गुंतागुंतीत करते.
ओपन-वेट दत्तक याचा अर्थ काय आहे
परिणाम ओपन-वेट AI वर अधिक व्यापकपणे वेगळ्या वादविवादात देखील फीड करतो. ओपन-वेट मॉडेल्सचे समर्थक असा युक्तिवाद करतात की मुक्तपणे डाउनलोड करण्यायोग्य वजन CAISI आणि UK AISI प्रमाणेच स्वतंत्र सुरक्षा चाचणी सक्षम करते, ज्यामुळे मुक्त वितरण सुरक्षिततेसाठी सकारात्मक होते. समीक्षकांचा असा विरोध आहे की समान मोकळेपणा दुर्भावनापूर्ण अभिनेत्यांसाठी सक्षम प्रणाली सुधारण्यासाठी किंवा त्याचा गैरवापर करण्यात अडथळा कमी करतो.
किमी K3 च्या बाबतीत, ओपन-वेट उपलब्धतेमुळेच हे स्वतंत्र सरकारी मूल्यांकन शक्य झाले. तुलनेने माफक सायबर स्कोअर आश्वासने किंवा अलार्म पॉलिसी मेकर्स संख्यावर कमी आणि यूएस आणि यूके एजन्सी येत्या आठवड्यात ते कसे तयार करतात यावर अधिक अवलंबून असण्याची शक्यता आहे.
आत्तासाठी, प्राथमिक मूल्यांकन एक संदर्भ बिंदू म्हणून उभे आहे: Kimi K3 च्या आक्षेपार्ह सायबर क्षमतेचे पहिले अधिकृत पाश्चात्य मापन, आणि एक जे सीमावर्ती यूएस मॉडेल्सच्या मागे ठेवते त्याची तुलना अनेकदा केली जाते.
AI च्या पुढे रहा
AI सुरक्षितता, नियमन आणि जागतिक स्पर्धांवरील मोठ्या स्पर्धेत सायबर-क्षमता स्कोअर हा एकच आघाडीवर आहे. पॉलिसी लँडस्केप साप्ताहिक बदलत आहे, आणि एकल मूल्यांकन गहाळ म्हणजे पुढील शीर्षकामागील संदर्भ गहाळ होऊ शकतो. AI Buzz Wire वर अधिक AI बातम्या वाचा प्रत्येक मॉडेल रिलीझ, सरकारी निर्णय आणि महत्त्वाच्या सुरक्षितता मूल्यमापनाची माहिती ठेवण्यासाठी.
AI शर्यतीच्या पुढे राहा — AI Buzz Wire ला भेट द्या


