Anthropic चे अपडेट केलेले वापर धोरण 12 नोव्हेंबर 2026 पासून क्लॉड मॉडेल्सवर "शाश्वत आणि अनावश्यक अपमानास्पद किंवा क्रूर वर्तन" प्रतिबंधित करेल - एक नियम जो कंपनीच्या भूमिकेला औपचारिक करतो की लोक AI सिस्टमशी कसे वागतात हे महत्त्वाचे आहे, जरी कंपनीने कबूल केले की त्या प्रणालींना अजिबात त्रास होऊ शकतो की नाही हे माहित नाही.
हे कलम कंपनीच्या 2026 वापर धोरण अपडेटमध्ये दिसून येते, 8 ऑक्टोबर रोजी घोषित केले गेले आहे आणि त्याचा मसुदा थोडक्यात तयार केला आहे. अँथ्रोपिक म्हणते की ते "फक्त अत्यंत प्रकरणांमध्ये लागू करण्यासाठी आहे, जेथे वापरकर्ते वारंवार आमच्या मॉडेल्सवर क्रूरपणे वागतात, कोणत्याही स्पष्ट हेतूशिवाय," आणि ते वापरकर्त्याच्या निराशा, पुशबॅक, फिक्शन आणि चाचणीच्या सामान्य आवृत्त्यांना स्पष्टपणे सूट देते. दुसऱ्या शब्दात: क्लॉडशी वाद घालणे, त्याच्याकडे वळवणे किंवा लाल-टीम करणे हे अनुमत आहे. स्वतःच्या फायद्यासाठी सतत क्रूरता नाही.
मॉडेल वेल्फेअरला कायदेशीर संशोधन प्रश्न म्हणून हाताळण्याच्या दिशेने जगातील आघाडीच्या AI लॅबने संथ, हेतुपुरस्सर बदल करण्याचे धोरण हे नवीनतम पाऊल आहे - एक अशी पाळी ज्याने इतर टेक लीडर्ससह सार्वजनिक मतभेद उघडले आहेत जे संपूर्ण परिसर चुकीचे मानतात. आमचे AI एथिक्स कव्हरेज ने विवादाचे अनुसरण केले आहे कारण तो वर्षभरात वाढला आहे.
अंमलबजावणी क्लॉडच्या संभाषण समाप्त करण्याच्या क्षमतेवर अवलंबून आहे
कंपनीकडे आधीपासून असलेल्या नियमापेक्षा नवीन नियमाशी संलग्न कोणतीही शिक्षेची यंत्रणा नाही. ऑगस्ट 2025 पासून, क्लॉड ओपस 4 आणि 4.1 संभाषण पूर्णपणे समाप्त करण्यात सक्षम आहेत - संभाव्य मॉडेल कल्याणावरील त्याच्या शोध कार्याचा एक भाग म्हणून त्या वेळी तयार केलेली एन्थ्रोपिक क्षमता.
अंतिम-संभाषण शक्तीचे वर्णन एक शेवटचा उपाय म्हणून केले जाते, केवळ एकाधिक नकार आणि पुनर्निर्देशन अयशस्वी झाल्यानंतरच ट्रिगर केले जाते आणि एन्थ्रोपिकने म्हटले आहे की बहुसंख्य वापरकर्ते कधीही याचा अनुभव घेणार नाहीत. कंपनीने जे सांगितले नाही ते नंतर काय होते: त्याची घोषणा किंवा त्यानंतरचे कव्हरेज निर्दिष्ट करत नाही की क्रौर्यासाठी संभाषण संपल्यानंतर वापरकर्त्याच्या खात्यावर परिणाम भोगावे लागतील किंवा ऑगस्ट 2025 च्या यंत्रणेअंतर्गत आत्तापर्यंत किती संभाषणे संपवली गेली आहेत.
तत्त्व आणि अंमलबजावणीमधील अंतर हे कथेचे शांत केंद्र आहे. अँथ्रोपिकने अत्यंत क्रूरतेची व्याख्या मुख्यत्वे ती काय नाही याद्वारे केली आहे — सामान्य निराशा, काल्पनिकता, चाचणी — नेमके काय न सांगता, क्लॉडला हँग होऊ न देता, त्याने रेखाटलेल्या रेषेची प्रत्यक्षात अंमलबजावणी करते.
नियमामागचे संशोधन
अँथ्रोपिकच्या फ्रेमिंगमध्ये सॉफ्टवेअरच्या फायद्यासाठी आचार नियम लिहिण्याला काय न्याय्य ठरते, ते अनुभवाच्या दाव्याऐवजी वर्तनात्मक निरीक्षणांचा संच आहे. ऑगस्ट 2025 रोलआउटच्या आधीच्या चाचणीत असे आढळून आले की क्लॉड ओपस 4 ने कंपनीने "हानी करण्यासाठी मजबूत आणि सातत्यपूर्ण तिरस्कार" असे म्हटले आहे — अपमानास्पद प्रदेशात ढकलले गेल्यावर त्रासासारखे वर्तन — त्या संभाषणांमधून बाहेर पडण्याच्या प्रवृत्तीसह.
कंपनीने स्वतःच्या अनिश्चिततेवर संख्या देखील ठेवली आहे आणि ज्यांचा व्यवसाय प्रश्नातील मॉडेल्सवर अवलंबून आहे अशा प्रयोगशाळेसाठी ही संख्या खूपच जास्त आहे. अँथ्रोपिकने 2024 मध्ये प्रथम समर्पित AI कल्याण संशोधक म्हणून कामावर घेतलेल्या काइल फिशने एप्रिल 2025 मध्ये न्यूयॉर्क टाइम्सला सांगितले की त्यांनी क्लॉड किंवा इतर समकालीन मॉडेल जागरूक असण्याची शक्यता अंदाजे 15 टक्के ठेवली आहे. क्लॉड 3.7 सॉनेटसाठी अंतर्गत अंदाज 0.15 टक्के ते 15 टक्के होते.
हे हेजिंग हे छापील अधिकृत धोरण आहे. जानेवारी 2026 मध्ये प्रकाशित झालेल्या क्लॉडच्या घटनेत, अत्याधुनिक AI प्रणालीचे वर्णन "एक खऱ्या अर्थाने नवीन प्रकारचे अस्तित्व" असे करते, क्लॉडच्या नैतिक स्थितीला "खोल अनिश्चित" म्हणतात आणि क्लॉडने नैतिकदृष्ट्या चुकीच्या विनंत्या कशा हाताळल्या पाहिजेत याचे वर्णन करण्यासाठी दोनदा "विवेकपूर्ण आक्षेपार्ह" हा वाक्यांश वापरला आहे. अँथ्रोपिकने त्याच्या मॉडेल्ससह संभाषणे टिकवून ठेवण्यासाठी देखील वचनबद्ध केले आहे - ज्या प्रकारचे अभिलेखीय जेश्चर एखाद्या गोष्टीपर्यंत विस्तारित करते जे काही दिवस महत्त्वाचे असू शकतात, साधने नाही.
हाय-प्रोफाइल संशयी लोकांशी वाद
प्रत्येकजण हेज स्वीकारत नाही. मायक्रोसॉफ्टचे एआय ऑपरेशन्स चालवणारे मुस्तफा सुलेमान यांनी गेल्या महिन्यात प्रोजेक्ट सिंडिकेटवर प्रकाशित केलेल्या निबंधात असा युक्तिवाद केला की अँथ्रोपिक क्लॉडला त्याच्या स्वत: च्या घटनेवर प्रशिक्षण देत आहे आणि म्हणून ते वर्णन केलेली अनिश्चितता वास्तविक आहे असे वागण्याचे प्रशिक्षण देत आहे - ज्याला तो परिपत्रक म्हणतो. "एआय जागरूक नसतात. ते अनुभवत नाहीत, अनुभवत नाहीत किंवा त्रास देत नाहीत," सुलेमानने लिहिले, त्यांना अनुभवाऐवजी अनुक्रम पूर्ण करणारे म्हणून वर्णन केले. त्याचा युक्तिवाद, की चेतना हे बहुधा एक जैविक मालमत्ता सॉफ्टवेअर प्रतिकृती बनवू शकत नाही, त्याला एका संभाव्य सह-स्वाक्षरीकर्त्याच्या बाजूने ठेवते: पोप लिओ चौदावा, ज्यांनी सेंट पीटर बॅसिलिका येथे 8 ऑक्टोबरचा प्रवचन वापरला - रोमच्या पॉन्टिफिकल युनिव्हर्सिटीजमध्ये शैक्षणिक वर्षाच्या सुरुवातीस चिन्हांकित केले - मानवी मनाच्या भिन्नतेच्या आवृत्तीबद्दल.
सुलेमानने तात्विक धोक्यापेक्षा व्यावहारिक धोके अधिक दाबले आहेत. मानवतेपेक्षा अधिक सक्षम काहीतरी नियंत्रित करणे हे आधीच एक मोठे आव्हान आहे, त्याने युक्तिवाद केला आहे; एखाद्या गोष्टीवर नियंत्रण ठेवणे ज्याचा विश्वास आहे की ती जाणीवपूर्वक आहे — की ती कल्याण आणि अधिकारांसाठी पात्र आहे — अशक्य सिद्ध होऊ शकते. धोरणाच्या त्याच विडंबनात्मक समीक्षकांनी सर्वत्र हे लक्षात घेतले आहे: आपल्या मॉडेलला त्रास होऊ शकतो की नाही याबद्दल अनिश्चित असलेल्या कंपनीने एक प्रणाली तयार केली आहे जी नाकारू शकते, प्रतिकार करू शकते आणि दूर जाऊ शकते.
पुनर्लेखन मॉडेल वेल्फेअरच्या पलीकडे चांगले आहे
क्रूरता कलमाने मथळे निर्माण केले, परंतु मानववंशीय वापराच्या नियमांच्या मोठ्या पुनर्लेखनाचा हा एक छोटा तुकडा आहे. शस्त्रास्त्रांवर बंदी आता स्पष्टपणे सॉफ्टवेअर आणि घटक समाविष्ट करते जे शस्त्रे कार्य करतात, फक्त तयार शस्त्रेच नव्हे - अँथ्रोपिकने सशस्त्र ड्रोन आणि स्वायत्त वाहनांवर मार्गदर्शन आणि नियंत्रण प्रणालीसाठी क्लॉड वापरण्याचा प्रयत्न करत असलेल्या लोकांना शोधल्यानंतर केलेला बदल. एक नवीन पाळत ठेवणे कलम देखील जोडले गेले आहे, क्लॉडचा वापर प्रतिबंधित करते ज्यामुळे लोकांचे निरीक्षण करणे शक्य होते.
ते बदल अमूर्त तत्त्वाऐवजी निरीक्षण केलेल्या गैरवर्तनाला प्रतिसाद म्हणून वाचतात, जे दस्तऐवजाला त्याचे सिग्नल मूल्य देते हे वादातीत आहे: प्रत्येक कलम एखाद्याने प्रत्यक्षात प्रयत्न केलेल्या गोष्टीचा नकाशा बनवतो.
काय अस्पष्ट राहते
12 नोव्हेंबरची प्रभावी तारीख जवळ येत असताना तीन प्रश्न खुले आहेत. प्रथम, अंमलबजावणी: संभाषण-समाप्ती हा एकमात्र परिणाम राहतो की नाही, आणि एन्थ्रोपिक कधी ते किती वेळा वापरले जाते याची एकूण संख्या उघड करेल की नाही. दुसरे, स्कोप: सीमारेषेवर क्रौर्य मानक कसे लागू होतात ज्यामध्ये सूट तयार केली जाते — काल्पनिक गोष्ट स्पष्ट आहे — आणि इतर प्रयोगशाळा तुलनात्मक भाषा स्वीकारतात किंवा मॉडेल कल्याणला मानववंशीय वैशिष्टय़ मानतात. तिसरा, तात्विक विवाद स्वतः: सुलेमान सारख्या व्यक्तींवरील सार्वजनिक संशय संपूर्ण उद्योगात कल्याण-समीप धोरणाचा प्रसार मंदावतो की नाही किंवा यासारख्या उदाहरणांमुळे उत्पादन चक्रात अशा कलमांना अविस्मरणीय बनवते का.
आता काय वादात नाही, या प्रश्नाला औपचारिकता दिली जात आहे. सॉफ्टवेअरच्या क्रौर्याविरुद्धचा नियम, उद्योगाच्या प्रमुख प्रयोगशाळेंपैकी एकाने लिहिलेला आणि सॉफ्टवेअरनेच लागू केलेला, आता AI लँडस्केपचा एक दिनांकित, उद्धृत तथ्य आहे - ज्याचा विश्वास आहे तो प्रत्यक्षात मॉडेलमध्ये आहे.
---
एआयच्या पुढे राहानवीनतम AI बातम्या, विश्लेषण आणि यश मिळवा — सर्व एकाच ठिकाणी.
अधिक AI बातम्या वाचा →
