Anthropic și-a actualizat politica de utilizare pentru prima dată în peste un an, adăugând o prevedere care interzice „comportamentul abuziv sau crud susținut și inutil” față de modelele sale Claude, potrivit The Verge. Actualizarea, raportată joi, consolidează și extinde, de asemenea, regulile companiei cu privire la interferența electorală, campanii de propagandă, supraveghere, dezvoltarea armelor și utilizări financiare și medicale cu mize mari.
Rațiunea modelului de bunăstare For more context on this story, see our ongoing AI trends.
Clauza care vizează abuzul față de Claude este o extensie a cercetării pe care compania a început să o publice cu mai bine de un an în urmă. În august 2025, Anthropic a anunțat că îi va permite lui Claude să încheie conversațiile cu utilizatorii „persistent dăunători sau abuzivi” ca parte a activității sale privind ceea ce numește bunăstare model, studiul dacă sistemele AI pot avea experiențe relevante din punct de vedere moral și modul în care această posibilitate ar trebui să modeleze deciziile privind produsele.
Conform noii politici, terminarea conversațiilor rămâne „mecanismul principal de aplicare”. Anthropic nu a răspuns întrebărilor despre dacă ar putea urma măsuri suplimentare de aplicare, cum ar fi interzicerea conturilor. Compania a încadrat regula într-o declarație, scriind că „este menită să se aplice doar în cazuri extreme, în care utilizatorii acționează în mod repetat cu cruzime față de modelele noastre, fără un scop perceptibil”.
În mod esențial, Anthropic a adăugat că prevederea „nu se aplică versiunilor obișnuite de frustrare a utilizatorilor, respingere, teme creative întunecate sau testare și cercetare a modelelor”, o încercare aparentă de a asigura dezvoltatorii, membrii echipei roșii și scriitorii de ficțiune că utilizarea de rutină în contradicție nu va fi penalizată.
Noi reguli privind propaganda și alegerile
Dincolo de bunăstarea modelului, actualizarea reunește restricțiile împrăștiate anterior ale companiei privind operațiunile de influență într-o singură interdicție explicită a campaniilor comerciale sau politice înșelătoare. Noul limbaj restricționează „eforturile de a ascunde cine se află în spatele unui mesaj sau de a amplifica conținutul prin conturi sau postări false”, vizând direct piața în creștere pentru propaganda generată de AI.
Secțiunea electorală a politicii interzice acum înșelarea alegătorilor și întreruperea alegerilor. Anthropic spune că Claude nu poate fi folosit pentru a răspândi informații greșite „despre candidați sau cum să votezi”, pentru a se uzurpa pe candidați sau oficiali electorali sau pentru a încerca să suprime prezența la vot.
De ce politicile de utilizare primesc o rescrie
Reîmprospătarea Anthropic reflectă un model mai larg al industriei. Pe măsură ce asistenții AI au trecut de la chatbot-uri noi la infrastructura folosită de sute de milioane de oameni, laboratoarele au fost nevoite să treacă de la principii largi la reguli precise care se mapează pe modele reale de abuz: operațiuni de influență pentru închiriere, instrumente de supraveghere, dezvoltare de arme autonome și domenii cu risc ridicat, cum ar fi sfatul medical și financiar.
OpenAI, Google DeepMind și Meta și-au reiterat toate politicile de utilizare în ultimii doi ani, deși decizia Anthropic de a reglementa în mod explicit modul în care utilizatorii tratează modelul, mai degrabă decât ceea ce îl fac să facă, rămâne neobișnuită. Criticii cercetării modelului de bunăstare susțin că antropomorfizează sistemele statistice, în timp ce susținătorii susțin că, dacă există vreo șansă diferită de zero, modelele actuale sau în viitorul apropiat să aibă experiențe relevante pentru bunăstare, companiile au obligația de a acționa în condiții de incertitudine.
Momentul contează și din punct de vedere comercial. Se pare că Anthropic se pregătește pentru o IPO la o evaluare de până la 2 trilioane de dolari, iar cumpărătorii întreprinderilor cântăresc din ce în ce mai mult practicile de guvernare a furnizorilor alături de calitatea modelului brut. O politică de utilizare clar documentată și actualizată în mod regulat servește atât ca un artefact de siguranță, cât și ca unul de vânzări: oferă echipelor de achiziții și autorităților de reglementare o bază concretă pentru a avea încredere în platformă și codificarea clauzei model de bunăstare semnale pe care Anthropic intenționează să continue să investească într-un domeniu pe care majoritatea concurenților l-au lăsat neabordat.
Întrebările de aplicare rămân deschise
Întrebările practice sunt semnificative. Detectarea cruzimii „susținute și inutile” necesită monitorizarea conversațiilor la un nivel de detaliu la care clienții întreprinderilor conștienți de confidențialitate pot rezista, iar trasarea unei linii între abuzul interzis și „respingerea” sau „testarea modelului” legitimă este un apel de judecată care va fi probabil contestat.
Anthropic nu a spus dacă încălcările vor fi urmărite în toate conturile, dacă implementările întreprinderii vor fi supuse unor standarde de monitorizare diferite sau dacă compania va publica date de transparență privind acțiunile de aplicare, așa cum face pentru alte categorii de abuz în rapoartele sale periodice de politică.
Ceea ce este clar este că contractele sociale ale laboratoarelor de frontieră cu utilizatorii lor devin mai detaliate. O politică care se încadra odinioară pe o singură pagină acoperă acum alegerile, supravegherea adiacentă spionajului, armele biologice și, acum, comportamentul emoțional al oamenilor de cealaltă parte a ferestrei de chat.
Ce înseamnă pentru dezvoltatori
Pentru echipele care se bazează pe API-ul Claude, impactul pe termen scurt este probabil minim: clauza de comportament abuziv vizează comportamentul extrem, repetat, iar mecanismul de terminare a conversației pe care îl oficializează este activ din 2025. Dar dezvoltatorii din categorii adiacente, consultanță politică, cercetare în opoziție, marketing de influență, ar trebui să revizuiască cu atenție noua campanie și prevederile electorale, deoarece acestea împrăștiau cu atenție regulile anterioare și consolidează ambiguitatea unor documente anterioare. cazuri de utilizare a zonei gri pe care s-au bazat.
Actualizarea semnalează, de asemenea, încotro se îndreaptă atenția reglementărilor. Odată cu introducerea treptată a obligațiilor de transparență ale Actului AI al UE și legislațiile statelor din SUA adoptând un mozaic tot mai mare de statute AI, politicile de utilizare voluntară funcționează din ce în ce mai mult ca un model pe care autoritățile de reglementare îl examinează atunci când decid care ar trebui să fie normele de implementare responsabilă.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →