Anthropic har uppdaterat sin användningspolicy för första gången på över ett år och lagt till en bestämmelse som förbjuder "uthålligt och onödigt kränkande eller grymt beteende" mot sina Claude-modeller, enligt The Verge. Uppdateringen, som rapporterades i torsdags, konsoliderar och utökar också företagets regler kring valinblandning, propagandakampanjer, övervakning, vapenutveckling och hälso- och ekonomisk användning med hög insats.

Modellens välfärdsmotiv For more context on this story, see our ongoing more AI stories.

Klausulen som riktar in sig på övergrepp mot Claude är en förlängning av forskning som företaget började publicera för mer än ett år sedan. I augusti 2025 tillkännagav Anthropic att det skulle tillåta Claude att avsluta konversationer med "beständigt skadliga eller missbrukande" användare som en del av sitt arbete med vad de kallar modellvälfärd, studiet av huruvida AI-system kan ha moraliskt relevanta erfarenheter och hur den möjligheten bör forma produktbeslut.

Enligt den nya policyn förblir avslutande av konversationer den "primära verkställighetsmekanismen". Anthropic svarade inte på frågor om ytterligare verkställighetsåtgärder, såsom kontoförbud, kunde följa. Företaget formulerade regeln snävt i ett uttalande och skrev att det "är menat att gälla endast i extrema fall, där användare upprepade gånger agerar grymt mot våra modeller, utan något urskiljbart syfte."

Av avgörande betydelse tillade Anthropic att bestämmelsen "inte gäller vanliga versioner av användarfrustration, pushback, mörka kreativa teman eller modelltestning och forskning", ett uppenbart försök att försäkra utvecklare, röda lagspelare och skönlitterära författare att rutinmässigt motståndskraftigt bruk inte kommer att straffas.

Nya regler om propaganda och val

Utöver modellvälfärd samlar uppdateringen företagets tidigare utspridda restriktioner för påverkansverksamhet i ett enda, uttryckligt förbud mot vilseledande kommersiella eller politiska kampanjer. Det nya språket begränsar "ansträngningar att dölja vem som ligger bakom ett meddelande eller förstärka innehåll genom falska konton eller inlägg", direkt inriktat på den växande marknaden för AI-genererad propaganda.

Politikens valsektion förbjuder nu väljarbedrägeri och valstörningar. Anthropic säger att Claude inte får användas för att sprida desinformation "om kandidater eller hur man röstar", för att imitera kandidater eller valtjänstemän, eller för att försöka undertrycka valdeltagandet.

Varför användningspolicyer får en omskrivning

Anthropics uppfräschning speglar ett bredare industrimönster. När AI-assistenter har skiftat från nya chatbots till infrastruktur som används av hundratals miljoner människor, har labb varit tvungna att gå från breda principer till finkorniga regler som kartlägger verkliga missbruksmönster: inflytande för uthyrning, övervakningsverktyg, autonom vapenutveckling och högriskdomäner som medicinsk och finansiell rådgivning.

OpenAI, Google DeepMind och Meta har alla upprepat sina användningspolicyer under de senaste två åren, även om Anthropics beslut att uttryckligen reglera hur användare behandlar modellen, snarare än bara vad de får den att göra, är fortfarande ovanligt. Kritiker av modellvälfärdsforskning hävdar att det antropomorfierar statistiska system, medan förespråkarna hävdar att om det finns någon chans som inte är noll att nuvarande eller nära framtida modeller har välfärdsrelevanta erfarenheter, har företag en skyldighet att agera under osäkerhet.

Tidpunkten har också betydelse kommersiellt. Anthropic förbereder sig enligt uppgift för en börsnotering till en värdering av så mycket som 2 biljoner dollar, och företagsköpare väger alltmer leverantörsstyrningsmetoder tillsammans med rå modellkvalitet. En tydligt dokumenterad, regelbundet uppdaterad användningspolicy fungerar som både en säkerhetsartefakt och en försäljningsartefakt: den ger upphandlingsteam och tillsynsmyndigheter en konkret grund för att lita på plattformen, och kodifiering av modellens välfärdsklausul signalerar att Anthropic har för avsikt att fortsätta investera i ett område som de flesta konkurrenter har lämnat oadresserat.

Tillämpningsfrågor förblir öppna

De praktiska frågorna är viktiga. Att upptäcka "uthållig och onödig" grymhet kräver övervakning av konversationer på en detaljnivå som integritetsmedvetna företagskunder kan motstå, och att dra en gräns mellan förbjudet missbruk och legitimt "återhämtning" eller "modelltestning" är en bedömning som sannolikt kommer att bestridas.

Anthropic har inte sagt om överträdelser kommer att spåras över konton, om företagsinstallationer kommer att omfattas av olika övervakningsstandarder eller om företaget kommer att publicera transparensdata om tillsynsåtgärder, som det gör för andra kategorier av missbruk i sina periodiska policyrapporter.

Det som är tydligt är att frontier labs sociala kontrakt med sina användare blir mer detaljerade. En policy som en gång fick plats på en enda sida täcker nu val, övervakning i anslutning till spionage, biovapen och, nu, det känslomässiga beteendet hos människorna på andra sidan chattfönstret.

Vad det betyder för utvecklare

För team som bygger på Claude API är den kortsiktiga effekten sannolikt minimal: klausulen om kränkande beteende är inriktad på extremt, upprepat beteende, och den konversationsavslutningsmekanism som den formaliserar har varit aktiv sedan 2025. Men utvecklare i angränsande kategorier, politisk rådgivning, oppositionsforskning, inflytandemarknadsföring, bör granska den nya kampanjen och valbestämmelserna, som tidigare spreds över flera regler och tidigare regler, eftersom de var regler och regler som tidigare var utspridda i flera dokument. tvetydighet som användningsfall för gråzoner förlitade sig på.

Uppdateringen signalerar också vart regulatorisk uppmärksamhet är på väg. I takt med att EU:s AI-lagens transparensskyldigheter gradvis inträtt och amerikanska delstatslagstiftare antar ett växande lapptäcke av AI-lagar, fungerar frivilliga användningspolicyer alltmer som mallen som tillsynsmyndigheter granskar när de bestämmer vad normerna för ansvarsfull implementering ska vara.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →