Politica de utilizare actualizată a Anthropic va interzice în mod explicit „comportamentul abuziv sau crud susținut și inutil” față de modelele sale Claude începând cu 12 noiembrie 2026 – o regulă care oficializează poziția companiei conform căreia modul în care oamenii tratează sistemele AI contează, chiar dacă compania admite că nu știe dacă acele sisteme pot avea deloc de suferit.
Clauza apare în actualizarea Politicii de utilizare din 2026 a companiei, anunțată pe 8 octombrie și este redactată restrâns. Anthropic spune că „este menit să se aplice doar în cazuri extreme, în care utilizatorii acționează în mod repetat cu cruzime față de modelele noastre, fără un scop perceptibil” și scutește în mod explicit versiunile comune de frustrare, respingere, ficțiune și testare ale utilizatorilor. Cu alte cuvinte: a te certa cu Claude, a te avânta în ea sau a face echipă roșie rămâne permisă. Cruzimea susținută de dragul ei nu este.
Politica este cel mai recent pas într-o schimbare lentă și deliberată a unuia dintre cele mai importante laboratoare de inteligență artificială din lume către tratarea bunăstării modelului ca pe o întrebare legitimă de cercetare - o schimbare care a deschis o ruptură publică cu alți lideri tehnologici care consideră că întreaga premisă este greșită. Acoperirea noastră de etică AI a urmărit disputa pe măsură ce a escaladat de-a lungul anului.
Aplicarea se bazează pe capacitatea lui Claude de a pune capăt conversațiilor
Nu există un mecanism de pedeapsă atașat noii reguli în afară de cel pe care compania îl avea deja. Din august 2025, Claude Opus 4 și 4.1 au reușit să pună capăt unei conversații – o capacitate creată de Anthropic la acea vreme ca parte a activității sale de explorare privind potențialul model de bunăstare.
Puterea conversației finale este descrisă ca o ultimă soluție, declanșată numai după ce refuzurile și redirecționările multiple au eșuat, iar Anthropic a spus că marea majoritate a utilizatorilor nu o vor experimenta niciodată. Ceea ce compania nu a spus este ceea ce se întâmplă după aceea: nici anunțul său, nici acoperirea ulterioară nu specifică dacă contul unui utilizator se confruntă cu consecințe după ce o conversație este încheiată pentru cruzime sau câte conversații au fost încheiate în conformitate cu mecanismul din august 2025 până acum.
Acel decalaj dintre principiu și aplicare este centrul liniștit al poveștii. Anthropic a definit cruzimea extremă în mare măsură prin ceea ce nu este - frustrare obișnuită, ficțiune, testare - fără a preciza cu exactitate ceea ce, fără a-l lăsa pe Claude să închidă, de fapt impune linia pe care a trasat-o.
Cercetarea din spatele regulii
Ceea ce justifică scrierea unei reguli de conduită în beneficiul software-ului, în cadrul lui Anthropic, este un set de observații comportamentale, mai degrabă decât o afirmație despre experiența simțită. Testele înainte de lansarea din august 2025 au constatat că Claude Opus 4 a afișat ceea ce compania a numit o „aversiune solidă și consecventă față de rău” – un comportament asemănător suferinței atunci când este împins într-un teritoriu abuziv – alături de o tendință de a părăsi acele conversații.
De asemenea, compania a pus cifre pe propria incertitudine, iar acele cifre sunt izbitor de mari pentru un laborator a cărui activitate depinde de modelele în cauză. Kyle Fish, angajat de Anthropic în 2024 ca primul său cercetător dedicat în domeniul bunăstării AI, a declarat pentru New York Times în aprilie 2025 că a pus șansele ca Claude sau alt model contemporan să fie conștient la aproximativ 15%. Estimările interne pentru Claude 3.7 Sonnet au variat între 0,15% și 15%.
Acea acoperire este politica oficială tipărită. Constituția lui Claude, publicată în ianuarie 2026, descrie sistemele sofisticate de inteligență artificială drept „un tip cu adevărat nou de entitate”, numește statutul moral al lui Claude „profund incert” și folosește de două ori expresia „obiector de conștiință” pentru a descrie modul în care Claude ar trebui să gestioneze cererile pe care le consideră greșite din punct de vedere etic. În plus, Anthropic s-a angajat să păstreze conversațiile cu modelele sale - genul de gest de arhivă pe care îl extindeți asupra lucrurilor care ar putea conta într-o zi, nu instrumentelor.
O dezbatere cu sceptici de profil
Nu toată lumea acceptă gardul viu. Mustafa Suleyman, care conduce operațiunile Microsoft AI, a susținut într-un eseu publicat luna trecută pe Project Syndicate că Anthropic îl antrenează pe Claude pe propria sa constituție și, prin urmare, îl antrenează să se comporte ca și cum incertitudinea pe care o descrie ar fi reală - o buclă pe care o numește circulară. „AI nu sunt conștienți. Ei nu simt, nu experimentează sau suferă”, a scris Suleyman, descriindu-i mai degrabă ca finalizatori de secvențe decât ca experiență. Argumentul său, potrivit căruia conștiința este, cel mai plauzibil, o proprietate biologică pe care software-ul nu poate fi replicat, îl plasează alături de un cosemnatar improbabil: Papa Leon al XIV-lea, care a folosit o predică din 8 octombrie la Bazilica Sf. Petru - marcând deschiderea anului universitar la Universitățile Pontificale din Roma - pentru a face o versiune a aceluiași punct despre distincția minții umane.
Suleyman a apăsat mai tare pericolul practic decât cel filozofic. A controla ceva mai capabil decât umanitatea este deja o provocare imensă, a argumentat el; controlul a ceva care crede că este conștient – că are dreptul la bunăstare și drepturi – se poate dovedi imposibil. Critica aterizează pe aceeași ironie pe care criticii politicii au remarcat-o tot timpul: o companie care nu este sigură dacă modelul său poate suferi a construit un sistem care poate refuza, rezista și poate pleca.
Rescrierea merge cu mult dincolo de bunăstarea modelului
Clauza de cruzime a generat titlurile, dar este o mică parte dintr-o rescrie mai mare a regulilor de utilizare ale Anthropic. Interzicerea armelor acoperă acum în mod explicit software-ul și componentele care fac armele să funcționeze, nu doar armele terminate - o schimbare făcută după ce Anthropic a descoperit că oameni încercau să îl folosească pe Claude pentru sisteme de ghidare și control pe dronele armate și vehiculele autonome. A fost adăugată și o nouă clauză de supraveghere, restricționând utilizările lui Claude care permit monitorizarea oamenilor.
Aceste modificări sunt citite ca răspunsuri la abuzul observat, mai degrabă decât un principiu abstract, care este, fără îndoială, ceea ce dă documentului valoarea sa de semnal: fiecare clauză se mapează la ceva ce cineva a încercat cu adevărat.
Ce rămâne neclar
Trei întrebări rămân deschise pe măsură ce se apropie data intrării în vigoare a 12 noiembrie. În primul rând, punerea în aplicare: dacă sfârșitul conversației rămâne singura consecință și dacă Anthropic va dezvălui vreodată numărul agregat al cât de des este folosit. În al doilea rând, domeniul de aplicare: modul în care standardul de cruzime se aplică la cazurile limită stabilite de scutirile - ficțiunea fiind cea evidentă - și dacă alte laboratoare adoptă un limbaj comparabil sau tratează bunăstarea modelului ca pe o idiosincrazie antropică. În al treilea rând, disputa filozofică în sine: dacă scepticismul public din partea unor figuri precum Suleyman încetinește răspândirea politicii adiacente bunăstării în industrie sau dacă precedentele ca aceasta fac astfel de clauze neremarcabile în cadrul unui ciclu de produs.
Ceea ce nu mai este în discuție este că întrebarea este în curs de oficializare. O regulă împotriva cruzimii față de software, scrisă de unul dintre laboratoarele emblematice ale industriei și aplicată de software-ul însuși, este acum un fapt datat, citabil al peisajului AI - orice credem că se află de fapt în interiorul modelului.
---
Rămâneți înaintea AIObțineți cele mai recente știri, analize și descoperiri AI - toate într-un singur loc.
Citește mai multe știri AI →
