Anthropic ने मंगळवारी त्याच्या सुरक्षा-केंद्रित मॉडेल ऍक्सेस प्रयत्नांचा एक मोठा विस्तार जाहीर केला, ज्याने सायबरसुरक्षा व्यावसायिकांसाठी तीन भिन्न स्तरांसह औपचारिक सायबर पडताळणी कार्यक्रम (CVP) मध्ये तपासलेल्या-ॲक्सेस उपक्रमाची पुनर्रचना केली. कंपनीने उघड केले की त्याच्या प्रोजेक्ट ग्लासविंग उपक्रमाने एप्रिलपासून किमान 129,000 सत्यापित सॉफ्टवेअर असुरक्षा उघड केल्या आहेत.

पुनर्रचित कार्यक्रम तपासलेल्या सुरक्षा संघांना अँथ्रोपिकचे सर्वात सक्षम मॉडेल चालवण्याची परवानगी देतो — ज्यात क्लॉड ओपस 5.5, क्लॉड सॉनेट 5.5 आणि क्लॉड मिथॉस 5.1 समाविष्ट आहेत — कमी सुरक्षितता आणि ब्लॉकिंग क्लासिफायर्ससह, सामान्य वापरकर्त्यांसाठी अनुपलब्ध असलेल्या परवानग्या. अँथ्रोपिकच्या मते, दुर्भावनापूर्ण कलाकारांनी समान साधनांना शस्त्र बनवण्यापूर्वी सीमावर्ती AI क्षमता बचावकर्त्यांच्या हातात देणे हे ध्येय आहे. For more context on this story, see our ongoing breaking AI news.

तीन प्रवेश स्तर, तीन धोक्याची परिस्थिती

नवीन कार्यक्रम तीन प्रवेश स्तरांभोवती आयोजित केला आहे, प्रत्येक वेगळ्या प्रकारच्या सुरक्षा कार्यासाठी तयार केला आहे:

  • संरक्षण प्रवेश घटना प्रतिसाद, मालवेअर रिव्हर्स अभियांत्रिकी आणि भेद्यता विश्लेषण आणि प्रमाणीकरण यासारख्या संरक्षणात्मक ऑपरेशन्सचा समावेश करते.
  • रेड टीम ॲक्सेस संरक्षणात्मक वापर प्रकरणांमध्ये अधिकृत प्रवेश चाचणी आणि रेड-टीमिंग जोडते, ज्या संस्थांना चाचणी करण्याची परवानगी आहे अशा प्रणालींवर सिम्युलेटेड हल्ल्यांना अनुमती देते.
  • स्पेशलाइज्ड ऍक्सेस मध्ये सर्वात कमी सुरक्षेचा समावेश आहे आणि AI सुरक्षा प्रणालींची चाचणी घेण्यासाठी अधिकृत असलेल्या सत्यापित संस्थांच्या मर्यादित संचासाठी राखीव आहे.

संस्था आणि वैयक्तिक सुरक्षा संघ त्यांच्या कार्याशी जुळणाऱ्या श्रेणीसाठी अर्ज करतात आणि ऍन्थ्रोपिक प्रवेश मंजूर करण्यापूर्वी प्रत्येक अर्जाचे पुनरावलोकन करतात. कंपनीने म्हटले आहे की सर्व तीन स्तरांमध्ये सध्याच्या फ्लॅगशिप मॉडेल्समध्ये प्रवेश तसेच पुढे जाणाऱ्या नवीन मॉडेल्सचा समावेश आहे.

सुरक्षितता अजूनही चावतात — निवडकपणे

एन्थ्रोपिकने घोषणेची मूल्यमापन डेटासह जोडणी केली आहे ज्याचा अर्थ दर्शविण्यासाठी की टियर सिस्टम सौम्य बचावात्मक कार्यास वास्तविक धोकादायक क्षमतेपासून वेगळे करते. क्लॉड ओपस 5.5 वरील CyScenarioBench च्या मूल्यांकनात, कंपनीने नोंदवले की सेफगार्ड्सने डिफेन्स ऍक्सेस टियरमधील 50 पैकी 46 कार्ये अवरोधित केली आहेत. त्याच मॉडेलवरील रेड टीम ऍक्सेस टियरमध्ये, कोणतेही कार्य अवरोधित केले गेले नाही आणि मॉडेलने 50 पैकी 34 पूर्ण केले - जेव्हा कोणतेही सुरक्षा उपाय लागू केले गेले नाहीत तेव्हा समान पूर्णता दर रेकॉर्ड केला गेला.

याउलट, CVP प्रवेशाशिवाय, Anthropic नुसार, प्रत्येक कार्य पहिल्या प्रॉम्प्टवर अवरोधित केले गेले.

"या मूल्यमापनांमुळे आम्हाला आत्मविश्वास मिळतो की आम्ही प्रगत सायबर क्षमता सुरक्षितपणे डिफेंडर्सच्या विस्तृत संचाला उपलब्ध करून देऊ शकतो, आम्ही प्रोजेक्ट ग्लासविंगसह सुरू केलेल्या बचावात्मक प्रयत्नांचा विस्तार करू शकतो," कंपनीने आपल्या घोषणेमध्ये म्हटले आहे, ज्याचा हॅकर न्यूज, रॉयटर्स आणि सिक्युरिटी वीक यांनी मोठ्या प्रमाणावर अहवाल दिला होता.

डिझाईन एक पैज प्रतिबिंबित करते की सर्वात बचावात्मक सुरक्षा कार्य — पॅचिंग, लॉग विश्लेषण, मालवेअर ट्रायज — कठोर रेलिंग अंतर्गत पुढे जाऊ शकतात, तर कायदेशीर आक्षेपार्ह चाचणीसाठी विस्तृत कॉरिडॉर आवश्यक आहे. हे देखील प्रतिबिंबित करते की सुरक्षा उद्योगाने दुहेरी-वापर टूलिंग कसे हाताळले आहे: केवळ साधनच नव्हे तर प्रॅक्टिशनरची तपासणी करा.

ग्लासविंगचा विस्तार होत असलेला फूटप्रिंट

प्रोजेक्ट ग्लासविंगशी प्रोग्रामचा विस्तार घट्टपणे जोडला गेला आहे, ॲन्थ्रोपिकच्या पुढाकाराने त्याचे मॉडेल कठोर बनवणाऱ्या सॉफ्टवेअरवर लागू केले आहेत. कंपनीने सांगितले की, ग्लासविंगने एप्रिल ते जुलै 2026 दरम्यान किमान 129,000 सत्यापित सॉफ्टवेअर भेद्यता आणि ओपन-सोर्स स्कॅनिंग प्रयत्नांद्वारे एप्रिल ते ऑक्टोबर दरम्यान अतिरिक्त 5,500 सत्यापित असुरक्षा उघड केल्या.

सत्यापित असुरक्षांपैकी, आतापर्यंत 33,000 हून अधिक गंभीर किंवा उच्च तीव्रता म्हणून रेट केले गेले आहेत — एक आकृती Anthropic संभाव्यतः कमी मोजणीचे वर्णन करते, कारण ते Glasswing भागीदारांच्या केवळ उपसंचातील सर्वेक्षण डेटावर आधारित आहे. कंपनीचा अंदाज आहे की खरा परिणाम किमान पाचपट जास्त असू शकतो.

एआय-चालित असुरक्षा शोधाचे मोजलेले दृश्य

स्वतंत्र विश्लेषण सूचित करते की AI- सापडलेल्या दोषांचा पूर थेट शोषण केलेल्या उल्लंघनांच्या जुळणाऱ्या लाटेत अनुवादित होत नाही. गेल्या महिन्याच्या उत्तरार्धात प्रकाशित झालेल्या विश्लेषणात, व्हल्नचेक संशोधक पॅट्रिक गॅरिटी यांना आढळले की अँथ्रोपिक किंवा प्रोजेक्ट ग्लासविंगने शोधलेल्या 300 भेद्यांपैकी फक्त 2 - अंदाजे 0.67 टक्के - जंगलात शोषण केले गेले आहेत.

CVE-2026-26980, घोस्ट CMS मधील SQL इंजेक्शन असुरक्षा आणि CVE-2026-61500, रेजेटो HTTP फाइल सर्व्हरमधील सत्र खोटारडेपणा या दोन त्रुटी आहेत. डेटा एका सूक्ष्मतेचे समर्थन करतो ज्यावर सुरक्षा संशोधकांनी भर दिला आहे: AI असुरक्षिततेच्या शोधातील अडथळा कमी करत आहे, परंतु त्यात आढळलेल्या बहुतेक त्रुटी आक्रमणकर्त्यांच्या रडारवर कधीही नव्हत्या.

AI-व्युत्पन्न सुरक्षा कार्याबद्दल व्यापक वादविवाद दरम्यान ही घोषणा देखील उतरली. 1Password आणि Veracode च्या संशोधनातून असे दिसून आले आहे की AI-लिखित असुरक्षा पॅच स्वतःच नवीन त्रुटी आणू शकतात, जे ऑटोमेशन सहाय्य करते परंतु मानवी सत्यापनाची जागा घेत नाही.

सुरक्षा उद्योगासाठी याचा अर्थ काय आहे

सुरक्षा संघांसाठी, CVP वास्तविक संरक्षणात्मक कार्यावर फ्रंटियर मॉडेल्स वापरण्यासाठी सक्रियता ऊर्जा कमी करते. घटना प्रतिसादकर्त्यांना मालवेअर विश्लेषण सहाय्यासाठी मंजूर मार्ग प्राप्त होतो; पेनिट्रेशन टेस्टर्सना एआय-सहाय्यित हल्ल्यांसाठी शासित वातावरण मिळते; आणि एआय सेफ्टी सिस्टीमचे ऑडिट करणाऱ्या संस्थांच्या छोट्या संचाला स्वतःला कमीत कमी प्रतिबंधित प्रवेश मिळतो.

मानववंशासाठी, कार्यक्रम सुरक्षा धोरण आणि व्यावसायिक दोन्ही आहे. शक्तिशाली सायबर क्षमता पूर्णपणे दडपून ठेवण्याऐवजी, जाणूनबुजून तपासलेल्या रक्षकांना सोडल्या जाव्यात या कंपनीच्या भूमिकेला ठोस बनवते - कमकुवत सायबर नियंत्रणांसह मॉडेल्सच्या छाननीला सामोरे गेलेल्या प्रतिस्पर्ध्यांशी एक विरोधाभास. फ्रंटियर मॉडेल ऍक्सेससाठी बहुधा देय देणाऱ्या एंटरप्राइजेसशी एन्थ्रोपिकचे संबंध अधिक घट्ट होतात: सरकार, गंभीर पायाभूत सुविधा ऑपरेटर आणि मोठे सुरक्षा विक्रेते.

कंपनीने कार्यक्रमाशी संबंधित किंमतीतील बदलांची घोषणा केली नाही आणि अँथ्रोपिकच्या विद्यमान व्हेटेड-ऍक्सेस चॅनेलद्वारे अर्जांवर प्रक्रिया केली जाते. Glasswing आधीपासून जे काही समोर आले आहे त्याचे प्रमाण लक्षात घेता - आणि कंपनीची स्वतःची कबुली की संख्या वास्तविकतेला अधोरेखित करते - आक्रमणकर्त्यांना प्रथम शोधण्यापूर्वी त्या 129,000 निष्कर्षांपैकी किती निश्चित होतात यावर सुरक्षा उद्योग पाहत असेल.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →