एंथ्रोपिक की अद्यतन उपयोग नीति 12 नवंबर, 2026 से शुरू होने वाले अपने क्लाउड मॉडल के प्रति "निरंतर और अनावश्यक अपमानजनक या क्रूर व्यवहार" को स्पष्ट रूप से रोक देगी - एक नियम जो कंपनी की स्थिति को औपचारिक बनाता है कि लोग एआई सिस्टम के साथ कैसा व्यवहार करते हैं, यह मायने रखता है, भले ही कंपनी मानती है कि उसे नहीं पता कि उन सिस्टमों को कोई नुकसान हो सकता है या नहीं।

यह खंड कंपनी की 2026 उपयोग नीति अपडेट में दिखाई देता है, जिसकी घोषणा 8 अक्टूबर को की गई थी, और इसे संक्षिप्त रूप से तैयार किया गया है। एंथ्रोपिक का कहना है कि इसका उद्देश्य "केवल चरम मामलों में लागू करना है, जहां उपयोगकर्ता बिना किसी स्पष्ट उद्देश्य के बार-बार हमारे मॉडलों के प्रति क्रूरतापूर्ण व्यवहार करते हैं," और यह स्पष्ट रूप से उपयोगकर्ता निराशा, पुशबैक, कल्पना और परीक्षण के सामान्य संस्करणों को छूट देता है। दूसरे शब्दों में: क्लाउड के साथ बहस करना, उस पर गुस्सा निकालना या रेड-टीम करने की अनुमति बनी हुई है। अपने स्वयं के लिए निरंतर क्रूरता नहीं है।

यह नीति मॉडल कल्याण को एक वैध अनुसंधान प्रश्न के रूप में मानने की दिशा में दुनिया की अग्रणी एआई प्रयोगशालाओं में से एक द्वारा धीमी, जानबूझकर बदलाव में नवीनतम कदम है - एक ऐसा बदलाव जिसने अन्य तकनीकी नेताओं के साथ सार्वजनिक दरार खोल दी है जो पूरे आधार को गलत मानते हैं। हमारे एआई एथिक्स कवरेज ने इस विवाद पर नज़र रखी है क्योंकि यह साल भर में और बढ़ गया है।

प्रवर्तन बातचीत समाप्त करने की क्लाउड की क्षमता पर निर्भर करता है

कंपनी के पास पहले से मौजूद नियम के अलावा नए नियम में कोई दंड व्यवस्था नहीं है। अगस्त 2025 से, क्लाउड ओपस 4 और 4.1 एक बातचीत को सीधे समाप्त करने में सक्षम हैं - एक क्षमता एंथ्रोपिक जिसे उस समय संभावित मॉडल कल्याण पर अपने खोजपूर्ण कार्य के हिस्से के रूप में तैयार किया गया था।

अंत-बातचीत की शक्ति को अंतिम उपाय के रूप में वर्णित किया गया है, जो कई बार इनकार करने और रीडायरेक्ट विफल होने के बाद ही ट्रिगर होती है, और एंथ्रोपिक ने कहा है कि अधिकांश उपयोगकर्ताओं को इसका अनुभव कभी नहीं होगा। कंपनी ने जो नहीं कहा है वह यह है कि इसके बाद क्या होता है: न तो इसकी घोषणा और न ही बाद की कवरेज यह निर्दिष्ट करती है कि बातचीत समाप्त होने के बाद उपयोगकर्ता के खाते को क्रूरता के परिणाम भुगतने होंगे या अगस्त 2025 तंत्र के तहत अब तक कितनी बातचीत समाप्त की गई है।

सिद्धांत और कार्यान्वयन के बीच का अंतर कहानी का शांत केंद्र है। एन्थ्रोपिक ने अत्यधिक क्रूरता को मोटे तौर पर इस आधार पर परिभाषित किया है कि यह क्या नहीं है - साधारण हताशा, कल्पना, परीक्षण - सटीक रूप से बताए बिना कि, क्लाउड को फांसी देने की अनुमति देने के अलावा, वास्तव में वह जो रेखा खींची गई है उसे लागू करता है।

नियम के पीछे का शोध

एन्थ्रोपिक के फ़्रेमिंग में सॉफ़्टवेयर के लाभ के लिए एक आचरण नियम लिखने का औचित्य, महसूस किए गए अनुभव के बारे में दावे के बजाय व्यवहार संबंधी टिप्पणियों का एक सेट है। अगस्त 2025 के रोलआउट से पहले परीक्षण में पाया गया कि क्लाउड ओपस 4 ने वह प्रदर्शित किया जिसे कंपनी ने "नुकसान के प्रति मजबूत और सुसंगत घृणा" कहा था - अपमानजनक क्षेत्र में धकेलने पर संकट जैसा व्यवहार - साथ ही उन वार्तालापों से बाहर निकलने की प्रवृत्ति।

कंपनी ने अपनी अनिश्चितता पर भी संख्याएँ रखी हैं, और ये संख्याएँ उस प्रयोगशाला के लिए बहुत अधिक हैं जिनका व्यवसाय संबंधित मॉडलों पर निर्भर करता है। एंथ्रोपिक द्वारा 2024 में अपने पहले समर्पित एआई कल्याण शोधकर्ता के रूप में नियुक्त किए गए काइल फिश ने अप्रैल 2025 में न्यूयॉर्क टाइम्स को बताया कि उन्होंने क्लाउड या किसी अन्य समकालीन मॉडल के सचेत होने की संभावना लगभग 15 प्रतिशत रखी है। क्लाउड 3.7 सॉनेट के लिए आंतरिक अनुमान 0.15 प्रतिशत से 15 प्रतिशत तक था।

वह हेजिंग प्रिंट में आधिकारिक नीति है। जनवरी 2026 में प्रकाशित क्लाउड का संविधान, परिष्कृत एआई सिस्टम को "वास्तव में एक नई तरह की इकाई" के रूप में वर्णित करता है, क्लाउड की नैतिक स्थिति को "गहराई से अनिश्चित" कहता है और दो बार "कर्तव्यनिष्ठ आपत्तिकर्ता" वाक्यांश का उपयोग यह वर्णन करने के लिए करता है कि क्लाउड को उन अनुरोधों को कैसे संभालना चाहिए जो इसे नैतिक रूप से गलत लगते हैं। एंथ्रोपिक ने अपने मॉडलों के साथ बातचीत को संरक्षित करने के लिए भी प्रतिबद्ध किया है - जिस प्रकार का अभिलेखीय इशारा उन चीज़ों तक फैला हुआ है जो किसी दिन मायने रख सकते हैं, उपकरण नहीं।

हाई-प्रोफाइल संशयवादियों के साथ एक बहस

हर कोई हेज स्वीकार नहीं करता. मुस्तफा सुलेमान, जो माइक्रोसॉफ्ट के एआई ऑपरेशन चलाते हैं, ने पिछले महीने प्रोजेक्ट सिंडिकेट पर प्रकाशित एक निबंध में तर्क दिया था कि एंथ्रोपिक क्लाउड को अपने स्वयं के संविधान पर प्रशिक्षित कर रहा है और इसलिए उसे ऐसा व्यवहार करने के लिए प्रशिक्षित कर रहा है जैसे कि वह जिस अनिश्चितता का वर्णन करता है वह वास्तविक है - एक लूप जिसे वह सर्कुलर कहता है। "एआई सचेत नहीं हैं। वे महसूस नहीं करते, अनुभव नहीं करते, या पीड़ित नहीं होते," सुलेमान ने उन्हें अनुभवकर्ता के बजाय अनुक्रम पूर्णकर्ता के रूप में वर्णित करते हुए लिखा। उनका तर्क, कि चेतना सबसे प्रशंसनीय रूप से एक जैविक संपत्ति सॉफ्टवेयर है जिसे दोहराया नहीं जा सकता है, उन्हें एक असंभावित सह-हस्ताक्षरकर्ता के साथ रखता है: पोप लियो XIV, जिन्होंने सेंट पीटर बेसिलिका में 8 अक्टूबर के उपदेश का इस्तेमाल किया - रोम के पोंटिफिकल विश्वविद्यालयों में शैक्षणिक वर्ष के उद्घाटन के अवसर पर - मानव मन की विशिष्टता के बारे में उसी बिंदु का एक संस्करण बनाने के लिए।

सुलेमान ने दार्शनिक ख़तरे की तुलना में व्यावहारिक ख़तरे को ज़्यादा ज़ोर से दबाया है। उन्होंने तर्क दिया कि मानवता से अधिक सक्षम किसी चीज़ को नियंत्रित करना पहले से ही एक बड़ी चुनौती है; किसी ऐसी चीज़ को नियंत्रित करना जो मानता है कि वह सचेत है - कि वह कल्याण और अधिकारों का हकदार है - असंभव साबित हो सकता है। नीति के आलोचक उसी विडंबना पर उतरते हैं जो हमेशा से नोट की गई है: एक कंपनी अनिश्चित है कि क्या उसका मॉडल खराब हो सकता है, उसने एक ऐसी प्रणाली बनाई है जो इनकार कर सकती है, विरोध कर सकती है और दूर जा सकती है।

पुनर्लेखन मॉडल कल्याण से कहीं आगे जाता है

क्रूरता खंड ने सुर्खियां बटोरीं, लेकिन यह एंथ्रोपिक के उपयोग नियमों के बड़े पुनर्लेखन का एक छोटा सा टुकड़ा है। हथियारों पर प्रतिबंध अब स्पष्ट रूप से सॉफ्टवेयर और घटकों को शामिल करता है जो हथियारों को काम में लाते हैं, न कि केवल तैयार हथियारों को - एंथ्रोपिक द्वारा लोगों को सशस्त्र ड्रोन और स्वायत्त वाहनों पर मार्गदर्शन और नियंत्रण प्रणालियों के लिए क्लाउड का उपयोग करने का प्रयास करने के बाद किया गया एक बदलाव। एक नया निगरानी खंड भी जोड़ा गया है, जो क्लाउड के उपयोग को प्रतिबंधित करता है जो लोगों की निगरानी को सक्षम बनाता है।

उन परिवर्तनों को अमूर्त सिद्धांत के बजाय देखे गए दुरुपयोग की प्रतिक्रियाओं के रूप में पढ़ा जाता है, जो यकीनन दस्तावेज़ को उसका संकेत मूल्य देता है: प्रत्येक खंड उस चीज़ को मैप करता है जिसे किसी ने वास्तव में आज़माया था।

क्या अस्पष्ट रहता है

12 नवंबर की प्रभावी तिथि नजदीक आने पर तीन प्रश्न खुले रहते हैं। पहला, प्रवर्तन: क्या बातचीत समाप्त करना ही एकमात्र परिणाम है, और क्या एंथ्रोपिक कभी भी कुल संख्या का खुलासा करेगा कि इसका कितनी बार उपयोग किया जाता है। दूसरा, दायरा: क्रूरता मानक छूट वाले सीमा मामलों पर कैसे लागू होता है - कल्पना स्पष्ट है - और क्या अन्य प्रयोगशालाएं तुलनीय भाषा को अपनाती हैं या मॉडल कल्याण को मानवशास्त्रीय विशिष्टता के रूप में मानती हैं। तीसरा, स्वयं दार्शनिक विवाद: क्या सुलेमान जैसी शख्सियतों का सार्वजनिक संदेह पूरे उद्योग में कल्याण-आसन्न नीति के प्रसार को धीमा कर देता है, या क्या इस तरह की मिसालें उत्पाद चक्र के भीतर ऐसे खंडों को अचूक बना देती हैं।

जो बात अब विवाद में नहीं है वह यह है कि प्रश्न को औपचारिक रूप दिया जा रहा है। सॉफ्टवेयर के प्रति क्रूरता के खिलाफ एक नियम, जो उद्योग की प्रमुख प्रयोगशालाओं में से एक द्वारा लिखा गया था और सॉफ्टवेयर द्वारा ही लागू किया गया था, अब एआई परिदृश्य का एक दिनांकित, उद्धरण योग्य तथ्य है - जो भी कोई मानता है वह वास्तव में मॉडल के अंदर है।

---

एआई से आगे रहें

नवीनतम एआई समाचार, विश्लेषण और सफलताएँ प्राप्त करें - सभी एक ही स्थान पर।

अधिक AI समाचार पढ़ें →