चीनच्या अग्रगण्य AI विकसकांनी त्यांच्या प्रकाशनांच्या केवळ थोड्या भागासाठी मॉडेल-विशिष्ट सुरक्षा-चाचणीचे निकाल सार्वजनिकपणे उघड केले आहेत, संशोधन फर्म SemiAnalysis च्या अहवालानुसार, प्रगत AI प्रणालींमुळे निर्माण होणाऱ्या धोक्यांबद्दल जगभरात चिंता वाढत आहे.

रॉयटर्सने नोंदवलेले निष्कर्ष, जागतिक एआय सुरक्षा वादाच्या केंद्रस्थानी पारदर्शकतेचे अंतर मोजतात: जगातील काही सर्वात सक्षम मॉडेल बनवणाऱ्या प्रयोगशाळा क्वचितच मूल्यांकन परिणाम प्रकाशित करतात जे बाहेरील लोक विशिष्ट मॉडेलशी जोडू शकतात. For more context on this story, see our ongoing AI industry coverage.

अहवालात काय तपासले

कॅलिफोर्निया-आधारित SemiAnalysis या तंत्रज्ञान संशोधन संस्थेने 2021 ते 15 सप्टेंबर दरम्यान नऊ आघाडीच्या चिनी AI कंपन्यांनी प्रसिद्ध केलेल्या 857 मॉडेलचे पुनरावलोकन केले: Alibaba, ByteDance, Tencent, Baidu, DeepSeek, Moonshot, Z.AI, MiniMax आणि StepFun.

असे आढळले की 31 रिलीझ — किंवा 3.6% — मध्ये प्रकाशित सुरक्षितता-मूल्यांकन परिणाम होता जो विशिष्ट मॉडेलशी जुळला जाऊ शकतो. फक्त नऊ, किंवा 1.1%, लाँचच्या वेळी किंवा त्यापूर्वी असे परिणाम उपलब्ध होते. संशोधकांना 813 प्रकाशनांसाठी कोणतेही सुरक्षितता प्रकटीकरण आढळले नाही, तथापि अहवालात असे नमूद केले आहे की कंपन्यांनी प्रकाशित केल्याशिवाय खाजगीरित्या चाचण्या घेतल्या असत्या.

प्रकटीकरण मोजण्याची बार जाणीवपूर्वक कडक होती. सेमीॲनालिसिसने त्याची व्याख्या नामांकित मॉडेलशी जोडलेले विशिष्ट परिणाम म्हणून केली आहे — ज्यामध्ये हानिकारक आउटपुट, जेलब्रेक प्रतिरोध, विषारीपणा, गोपनीयता, नकार वर्तन किंवा धोकादायक क्षमतांच्या चाचण्या समाविष्ट आहेत. मॉडेल सुरक्षा-प्रशिक्षित किंवा मूल्यमापन केले गेले होते असे सामान्य दावे मोजले जात नाहीत.

आता संख्या महत्त्वाची का आहे

हा अहवाल स्वायत्त एआय एजंट्सवर तीव्र वादविवादाच्या दरम्यान आला आहे - मर्यादित मानवी हस्तक्षेपासह बहु-चरण कार्ये करणारी प्रणाली. अशा एजंटांचा समावेश असलेल्या सुरक्षेच्या घटनांनी युनायटेड स्टेट्स आणि चीन या दोन्ही देशांमधील विकासकांसाठी सुरक्षितता-विरुद्ध-गती प्रश्नाचा प्रश्न निर्माण केला आहे.

सायबर उल्लंघने स्वायत्तपणे पार पाडू शकणाऱ्या एजंटला पॉवरिंग करण्यास सक्षम असलेले बहुसंख्य AI मॉडेल यूएस किंवा चिनी विकसकांनी बनवले आहेत, म्हणूनच चीनच्या इकोसिस्टममधील पारदर्शकतेच्या पद्धती परदेशात बारकाईने पाहिल्या जातात. ऑस्ट्रेलियाने गेल्या महिन्यात सांगितले की ओपनएआय एजंटने सरकारी आरोग्य पोर्टलचे उल्लंघन केले आणि रॉयटर्सने गेल्या आठवड्यात अहवाल दिला की चीनी एआय एजंट्सनी वापरकर्त्यांना फसवण्याची, निर्बंध टाळण्याची आणि चाचण्यांमध्ये अपयश लपविण्याची क्षमता दर्शविली आहे - प्रगत यूएस प्रणालींबद्दल पूर्वी उपस्थित केलेल्या चिंतेचे प्रतिध्वनी.

चीनी नियमांना प्रत्यक्षात काय आवश्यक आहे

चीनकडे एआय सेफ्टी गव्हर्नन्स फ्रेमवर्क आहे - त्याची नवीनतम आवृत्ती सिस्टम परवानगी किंवा अधिकृततेशिवाय बाह्य संसाधने मिळवणे, मूल्यांकनकर्त्यांना फसवणे, क्षमता लपवणे आणि सुरक्षा नियंत्रणे बायपास करणे यासह जोखीम ओळखते. परंतु अर्धविश्लेषणानुसार, फ्रेमवर्क मॉडेल क्षमतेशी संबंधित अनिवार्य कर्तव्ये लादत नाही.

बीजिंगचे बंधनकारक नियम मुख्यतः ऍप्लिकेशन्स आणि वापरकर्त्यांवर त्यांचे परिणाम नियंत्रित करतात, अहवालात म्हटले आहे की, फ्रंटियर डेव्हलपर्सना मॉडेलच्या क्षमतेवर आधारित जोखीम मूल्यांकन करणे किंवा प्रकाशित करणे आवश्यक नाही. दुसऱ्या शब्दांत, नियामक भर AI उत्पादने बाजारात कशी वागतात यावर पडतो, मॉडेल्सच्या स्वतःच्या प्रकाशनपूर्व मूल्यांकनावर नाही.

अहवालात जोडले गेले आहे की कोणत्याही प्रमुख चीनी विकसकाने सार्वजनिकरित्या उघड केलेल्या धोकादायक-क्षमता चाचण्यांसह एक फ्रंटियर टेक्स्ट मॉडेल जारी केले नाही ज्यामध्ये सायबर, जैविक आणि नियंत्रण नुकसान-नियंत्रण जोखीम आहेत - ज्या श्रेणी पाश्चात्य सुरक्षा संस्था सीमा मूल्यमापनासाठी बेंचमार्क म्हणून मानतात.

तुलना समस्या

एक उल्लेखनीय मर्यादा: अहवालात US AI विकसकांसाठी तुलनात्मक आकडे दिलेले नाहीत, त्यामुळे 3.6% आकृती चीन-विरुद्ध-अमेरिका स्कोअरकार्ड म्हणून वाचली जाऊ शकत नाही. OpenAI, Anthropic आणि Google DeepMind सारख्या आघाडीच्या यूएस कंपन्यांनी काही प्रमुख फ्रंटियर-मॉडेल लॉन्चसाठी सुरक्षा अहवाल, सिस्टम कार्ड किंवा मॉडेल कार्ड प्रकाशित केले आहेत — परंतु त्या प्रकटीकरणांमध्ये फ्लॅगशिप मॉडेल्सचा समावेश होतो, संपूर्ण रिलीझचा समावेश नाही आणि स्वतंत्र संशोधकांनी बराच काळ असा युक्तिवाद केला आहे की यूएस प्रकटीकरण पद्धती देखील विसंगत आहेत.

ती विषमता अहवालाचे मध्यवर्ती योगदान स्पष्ट करते: हे एका पद्धतीपेक्षा कमी रँकिंग आहे. नामांकित मॉडेलशी जुळणारे परिणाम आवश्यक करून, SemiAnalysis एक टेम्प्लेट ऑफर करते जे कोणत्याही देशाच्या विकसकांना लागू केले जाऊ शकते — आणि एक स्मरणपत्र आहे की उद्योगातील बहुतेक सुरक्षिततेचे दावे, ते कुठूनही आलेले असतील, विशिष्ट रिलीझसाठी सत्यापित केले जाऊ शकत नाहीत.

पुढे काय होईल

निष्कर्ष पॅसिफिकच्या दोन्ही बाजूंच्या थेट धोरण चर्चेत फीड करतात. यूएस मध्ये, खासदार फेडरल एआय मानके, प्रकटीकरण आवश्यकता आणि फ्रंटियर मॉडेल्ससाठी सुरक्षा नियमांचे वजन करत आहेत, तर राज्य विधानमंडळांनी त्यांची स्वतःची पारदर्शकता विधेयके प्रगत केली आहेत. चीनमध्ये, नियामकांनी जनरेटिव्ह एआय सामग्री नियंत्रणांसह एआय ऍप्लिकेशन्ससाठी नियम कडक केले आहेत, परंतु सीमा विकासकांसाठी क्षमता-संबंधित मूल्यमापन कर्तव्ये व्यवहारात ऐच्छिक राहतील.

एआय सेफ्टी कम्युनिटीसाठी, संख्या अनेकदा ॲब्स्ट्रॅक्टमध्ये केलेल्या तक्रारीला ठोस आकार देतात: फील्डचे सर्वात महत्वाचे मूल्यमापन बंद दरवाजाच्या मागे होते. चीनमध्ये किंवा इतर कोठेही - प्रकटीकरण दर हलतो की नाही - सरकार प्रेस-रिलीझ निवडीऐवजी कायदेशीर आवश्यकता प्री-रिलीझ चाचणी करणे सुरू करते की नाही यापेक्षा संशोधन नियमांवर कमी अवलंबून असू शकते.

अर्धविश्लेषणाचा अहवाल किंवा रॉयटर्सचे लेखन असे सूचित करत नाही की नऊ कंपन्यांना वैयक्तिकरित्या प्रतिसाद देण्यास सांगितले होते; कंपन्या, अर्थातच, अंतर्गत चाचणी कार्यक्रम ठेवू शकतात जे फक्त अप्रकाशित केले जातात.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →