Anthropic ha aggiornato la sua politica di utilizzo per la prima volta in oltre un anno, aggiungendo una disposizione che proibisce "comportamenti abusivi o crudeli prolungati e inutili" nei confronti dei suoi modelli Claude, secondo The Verge. L'aggiornamento, riportato giovedì, consolida ed espande anche le regole della compagnia in materia di interferenze elettorali, campagne di propaganda, sorveglianza, sviluppo di armi e usi sanitari e finanziari ad alto rischio.
La logica del modello di welfare Per maggiori informazioni su questa storia, consulta la nostra ultimi sviluppi nell'IA.
La clausola mirata agli abusi nei confronti di Claude è un'estensione della ricerca che la società ha iniziato a pubblicizzare più di un anno fa. Nell'agosto 2025, Anthropic ha annunciato che avrebbe consentito a Claude di terminare le conversazioni con utenti "persistentemente dannosi o abusivi" come parte del suo lavoro su quello che chiama welfare modello, lo studio sulla possibilità che i sistemi di intelligenza artificiale possano avere esperienze moralmente rilevanti e su come tale possibilità dovrebbe modellare le decisioni sui prodotti.
Secondo la nuova politica, la conclusione delle conversazioni rimane il "meccanismo di applicazione principale". Anthropic non ha risposto alle domande sull’eventualità che potessero seguire ulteriori misure di applicazione, come il blocco degli account. L'azienda ha inquadrato la regola in modo restrittivo in una dichiarazione, scrivendo che "è destinata ad applicarsi solo in casi estremi, in cui gli utenti agiscono ripetutamente in modo crudele nei confronti dei nostri modelli, senza alcuno scopo riconoscibile".
Fondamentalmente, Anthropic ha aggiunto che la disposizione "non si applica alle versioni comuni di frustrazione degli utenti, respingimenti, temi creativi oscuri o test e ricerche di modelli", un evidente tentativo di rassicurare sviluppatori, red-teamers e scrittori di narrativa che l'uso di routine contraddittorio non sarà penalizzato.
Nuove regole sulla propaganda e sulle elezioni
Al di là del modello di welfare, l’aggiornamento riunisce le restrizioni precedentemente sparse dell’azienda sulle operazioni di influenza in un unico, esplicito divieto di campagne commerciali o politiche ingannevoli. Il nuovo linguaggio limita “gli sforzi per oscurare chi c’è dietro un messaggio o amplificare il contenuto attraverso account o post falsi”, prendendo di mira direttamente il mercato in crescita della propaganda generata dall’intelligenza artificiale.
La sezione elettorale della politica ora proibisce l’inganno degli elettori e lo sconvolgimento elettorale. Anthropic afferma che Claude non può essere utilizzato per diffondere disinformazione "sui candidati o su come votare", per impersonare candidati o funzionari elettorali o per cercare di reprimere l'affluenza alle urne.
Perché le politiche di utilizzo verranno riscritte
Il rinnovamento di Anthropic riflette un modello di settore più ampio. Mentre gli assistenti di intelligenza artificiale sono passati dai nuovi chatbot alle infrastrutture utilizzate da centinaia di milioni di persone, i laboratori hanno dovuto passare da principi generali a regole dettagliate che si associano a modelli di abuso reali: operazioni di influenza a pagamento, strumenti di sorveglianza, sviluppo di armi autonome e settori ad alto rischio come la consulenza medica e finanziaria.
OpenAI, Google DeepMind e Meta hanno tutti ripetuto le loro politiche di utilizzo negli ultimi due anni, anche se la decisione di Anthropic di regolamentare esplicitamente il modo in cui gli utenti trattano il modello, piuttosto che solo ciò che gli fanno fare, rimane insolita. I critici della ricerca sui modelli di welfare sostengono che essa antropomorfizza i sistemi statistici, mentre i sostenitori sostengono che se esiste una possibilità diversa da zero che i modelli attuali o del prossimo futuro abbiano esperienze rilevanti per il welfare, le aziende hanno l’obbligo di agire in condizioni di incertezza.
Il tempismo conta anche dal punto di vista commerciale. Secondo quanto riferito, Anthropic si sta preparando per un’IPO con una valutazione di ben 2 trilioni di dollari, e gli acquirenti aziendali valutano sempre più le pratiche di governance dei fornitori insieme alla qualità del modello grezzo. Una politica di utilizzo chiaramente documentata e regolarmente aggiornata funge sia da artefatto di sicurezza che da strumento di vendita: fornisce ai team di procurement e alle autorità di regolamentazione una base concreta per fidarsi della piattaforma, e la codifica della clausola di welfare modello segnala che Anthropic intende continuare a investire in un’area che la maggior parte dei concorrenti ha lasciato irrisolta.
Le questioni relative all'applicazione restano aperte
Le questioni pratiche sono significative. Per individuare la crudeltà “prolungata e inutile” è necessario monitorare le conversazioni a un livello di dettaglio a cui i clienti aziendali attenti alla privacy potrebbero resistere, e tracciare una linea tra abuso proibito e legittimo “respingimento” o “test di modelli” è un giudizio che sarà probabilmente contestato.
Anthropic non ha detto se le violazioni verranno tracciate tra gli account, se le implementazioni aziendali saranno soggette a diversi standard di monitoraggio o se la società pubblicherà dati sulla trasparenza sulle azioni di applicazione, come fa per altre categorie di uso improprio nei suoi rapporti periodici sulla politica.
Ciò che è chiaro è che i contratti sociali dei laboratori di frontiera con i loro utenti stanno diventando sempre più dettagliati. Una politica che una volta stava in un’unica pagina, ora copre le elezioni, la sorveglianza legata allo spionaggio, le armi biologiche e, ora, la condotta emotiva degli umani dall’altra parte della finestra della chat.
Cosa significa per gli sviluppatori
Per i team che si basano sull’API Claude, l’impatto a breve termine è probabilmente minimo: la clausola sul comportamento abusivo prende di mira comportamenti estremi e ripetuti e il meccanismo di interruzione della conversazione che formalizza è attivo dal 2025. Ma gli sviluppatori di categorie adiacenti, consulenza politica, ricerca sull’opposizione, marketing di influenza, dovrebbero rivedere attentamente le nuove disposizioni sulla campagna e sulle elezioni, poiché consolidano regole precedentemente distribuite su più documenti e colmano alcune delle ambiguità su cui si basavano i casi d’uso delle aree grigie.
L’aggiornamento segnala anche dove si sta dirigendo l’attenzione normativa. Con l’introduzione graduale degli obblighi di trasparenza dell’EU AI Act e le legislature statali statunitensi che approvano un crescente mosaico di statuti sull’IA, le politiche di utilizzo volontario funzionano sempre più come modello che i regolatori esaminano attentamente quando decidono quali dovrebbero essere le norme per un’implementazione responsabile.
---
Rimani Aggiornato sull'IALe ultime notizie, analisi e scoperte sull'intelligenza artificiale — tutto in un posto.
Leggi altre notizie sull'IA →