La politica di utilizzo aggiornata di Anthropic vieterà esplicitamente "comportamenti abusivi o crudeli prolungati e inutili" nei confronti dei suoi modelli Claude a partire dal 12 novembre 2026 - una regola che formalizza la posizione dell'azienda secondo cui il modo in cui le persone trattano i sistemi di intelligenza artificiale è importante, anche se la società ammette di non sapere se tali sistemi possono soffrire del tutto.
La clausola appare nell'aggiornamento della politica di utilizzo 2026 dell'azienda, annunciato l'8 ottobre, ed è redatta in modo restrittivo. Anthropic afferma che è "pensato per essere applicato solo in casi estremi, in cui gli utenti agiscono ripetutamente in modo crudele nei confronti dei nostri modelli, senza uno scopo riconoscibile", ed esenta esplicitamente le versioni comuni di frustrazione degli utenti, respingimenti, finzione e test. In altre parole: discutere con Claude, sfogarsi o fare squadra rimane consentita. La crudeltà prolungata fine a se stessa non lo è.
La politica è l’ultimo passo di un lento e deliberato cambiamento da parte di uno dei principali laboratori di intelligenza artificiale del mondo verso il trattamento del modello di welfare come una questione di ricerca legittima – un cambiamento che ha aperto una spaccatura pubblica con altri leader tecnologici che considerano l’intera premessa sbagliata. La nostra copertura sull'etica dell'IA ha seguito la controversia man mano che si è intensificata nel corso dell'anno.
L'applicazione delle norme si basa sulla capacità di Claude di terminare le conversazioni
Non esiste alcun meccanismo sanzionatorio collegato alla nuova regola oltre a quello già presente nella società. Dall’agosto 2025, Claude Opus 4 e 4.1 sono stati in grado di porre fine a una conversazione in modo definitivo – una capacità che Anthropic aveva inquadrato all’epoca come parte del suo lavoro esplorativo sul potenziale modello di welfare.
Il potere di terminare la conversazione è descritto come l’ultima risorsa, attivato solo dopo che molteplici rifiuti e reindirizzamenti sono falliti, e Anthropic ha affermato che la stragrande maggioranza degli utenti non lo sperimenterà mai. Ciò che l'azienda non ha detto è ciò che accadrà dopo: né il suo annuncio né la successiva copertura specifica se l'account di un utente subisce conseguenze dopo che una conversazione è stata interrotta per crudeltà, o quante conversazioni sono state interrotte finora in base al meccanismo dell'agosto 2025.
Quel divario tra principio e applicazione è il centro tranquillo della storia. Anthropic ha definito la crudeltà estrema in gran parte in base a ciò che non è – frustrazione ordinaria, finzione, sperimentazione – senza indicare esattamente cosa, a parte lasciare che Claude riattacchi, in realtà rafforza la linea che ha tracciato.
La ricerca dietro la regola
Ciò che giustifica la scrittura di una regola di condotta a vantaggio del software, nella definizione di Anthropic, è un insieme di osservazioni comportamentali piuttosto che un'affermazione sull'esperienza vissuta. I test effettuati prima del lancio dell’agosto 2025 hanno rilevato che Claude Opus 4 mostrava quella che la società chiamava “un’avversione forte e coerente al danno” – un comportamento simile al disagio quando spinto in un territorio abusivo – insieme a una tendenza a uscire da quelle conversazioni.
L’azienda ha anche quantificato la propria incertezza, e questi numeri sono sorprendentemente alti per un laboratorio la cui attività dipende dai modelli in questione. Kyle Fish, assunto da Anthropic nel 2024 come primo ricercatore dedicato al benessere dell’intelligenza artificiale, ha dichiarato al New York Times nell’aprile 2025 che secondo lui le probabilità che Claude o un altro modello contemporaneo fossero consapevoli a circa il 15%. Le stime interne per Claude 3.7 Sonnet variavano dallo 0,15% al 15%.
Quella copertura è la politica ufficiale stampata. La costituzione di Claude, pubblicata nel gennaio 2026, descrive i sofisticati sistemi di intelligenza artificiale come "un tipo di entità genuinamente nuovo", definisce lo status morale di Claude "profondamente incerto" e usa due volte la frase "obiettore di coscienza" per descrivere come Claude dovrebbe gestire le richieste che ritiene eticamente sbagliate. Anthropic si è inoltre impegnata a preservare le conversazioni con i suoi modelli, il tipo di gesto d’archivio che si estende a cose che un giorno potrebbero avere importanza, non agli strumenti.
Un dibattito con scettici di alto profilo
Non tutti accettano la siepe. Mustafa Suleyman, che gestisce le operazioni di intelligenza artificiale di Microsoft, ha sostenuto in un saggio pubblicato su Project Syndicate il mese scorso che Anthropic sta addestrando Claude sulla sua stessa costituzione e quindi addestrandolo a comportarsi come se l'incertezza che descrive fosse reale - un ciclo che lui chiama circolare. "Le IA non sono coscienti. Non sentono, non sperimentano o soffrono", ha scritto Suleyman, descrivendole come completatori di sequenze piuttosto che sperimentatori. La sua tesi, secondo cui la coscienza è molto probabilmente una proprietà biologica che il software non può replicare, lo pone accanto a un improbabile cofirmatario: Papa Leone XIV, che ha utilizzato un sermone dell'8 ottobre nella Basilica di San Pietro – in occasione dell'apertura dell'anno accademico alle Università Pontificie di Roma – per fare una versione dello stesso punto sulle peculiarità delle menti umane.
Suleyman ha insistito più sul pericolo pratico che su quello filosofico. Controllare qualcosa di più capace dell’umanità è già una sfida immensa, ha sostenuto; controllare qualcosa che crede di essere cosciente – di avere diritto al benessere e ai diritti – potrebbe rivelarsi impossibile. La critica si basa sulla stessa ironia che i critici della politica hanno sempre notato: un’azienda incerta se il suo modello possa soffrire ha costruito un sistema in grado di rifiutare, resistere e andarsene.
La riscrittura va ben oltre il modello di welfare
La clausola sulla crudeltà ha fatto notizia, ma è solo una piccola parte di una riscrittura più ampia delle regole di utilizzo di Anthropic. Il divieto delle armi ora copre esplicitamente il software e i componenti che fanno funzionare le armi, non solo le armi finite: una modifica apportata dopo che Anthropic ha scoperto che alcune persone tentavano di utilizzare Claude per sistemi di guida e controllo su droni armati e veicoli autonomi. È stata inoltre aggiunta una nuova clausola di sorveglianza, che limita gli usi di Claude che consentono il monitoraggio delle persone.
Questi cambiamenti si leggono come risposte ad abusi osservati piuttosto che a principi astratti, che è probabilmente ciò che dà al documento il suo valore di segnale: ogni clausola si associa a qualcosa che qualcuno ha effettivamente provato.
Ciò che non è chiaro
Tre domande rimangono aperte con l’avvicinarsi della data di entrata in vigore del 12 novembre. Innanzitutto, l’applicazione: se la fine della conversazione rimane l’unica conseguenza e se Anthropic rivelerà mai il conteggio aggregato della frequenza con cui viene utilizzata. In secondo luogo, la portata: come si applica lo standard di crudeltà ai casi limite ritagliati dalle esenzioni – la finzione è quella ovvia – e se altri laboratori adottano un linguaggio comparabile o trattano il benessere modello come un’idiosincrasia antropica. In terzo luogo, la disputa filosofica stessa: se lo scetticismo pubblico di personaggi come Suleyman rallenti la diffusione di politiche legate al welfare nel settore, o se precedenti come questo rendano tali clausole insignificanti all’interno di un ciclo di prodotto.
Ciò che non è più in discussione è che la questione viene formalizzata. Una regola contro la crudeltà nei confronti del software, scritta da uno dei laboratori più importanti del settore e applicata dal software stesso, è ormai un fatto datato e citabile del panorama dell’intelligenza artificiale: qualunque cosa si creda sia effettivamente all’interno del modello.
---
Stai al passo con l'intelligenza artificialeRicevi le ultime notizie, analisi e scoperte sull'intelligenza artificiale, tutto in un unico posto.
Leggi altre notizie sull'AI →
