Laut The Verge hat Anthropic seine Nutzungsrichtlinien zum ersten Mal seit über einem Jahr aktualisiert und eine Bestimmung hinzugefügt, die „andauerndes und unnötiges missbräuchliches oder grausames Verhalten“ gegenüber seinen Claude-Modellen verbietet. Das am Donnerstag gemeldete Update konsolidiert und erweitert außerdem die Regeln des Unternehmens in Bezug auf Wahleinmischung, Propagandakampagnen, Überwachung, Waffenentwicklung sowie riskante Gesundheits- und Finanzzwecke.
Die vorbildliche Wohlfahrtsbegründung Weitere Informationen zu dieser Geschichte finden Sie in unserer KI-Branchenberichterstattung.
Die Klausel, die auf den Missbrauch von Claude abzielt, ist eine Erweiterung der Forschung, mit der das Unternehmen vor mehr als einem Jahr begonnen hat, es zu veröffentlichen. Im August 2025 kündigte Anthropic an, dass es Claude gestatten würde, Gespräche mit „anhaltend schädlichen oder missbräuchlichen“ Nutzern zu beenden, als Teil seiner Arbeit an dem, was es Modellwohlfahrt nennt, der Untersuchung, ob KI-Systeme moralisch relevante Erfahrungen machen können und wie diese Möglichkeit Produktentscheidungen beeinflussen sollte.
Nach der neuen Richtlinie bleibt das Beenden von Gesprächen der „primäre Durchsetzungsmechanismus“. Anthropic antwortete nicht auf Fragen, ob weitere Durchsetzungsmaßnahmen, wie etwa Kontosperrungen, folgen könnten. Das Unternehmen formulierte die Regel in einer Erklärung eng und schrieb, dass sie „nur in extremen Fällen gelten soll, in denen Benutzer sich wiederholt grausam gegenüber unseren Modellen verhalten, ohne erkennbaren Zweck.“
Entscheidend ist, dass Anthropic hinzufügte, dass die Bestimmung „nicht für gängige Versionen von Benutzerfrustration, Pushback, dunklen kreativen Themen oder Modelltests und -forschung gilt“, ein offensichtlicher Versuch, Entwicklern, Red-Teamern und Romanautoren zu versichern, dass routinemäßige kontroverse Nutzung nicht bestraft wird.
Neue Regeln für Propaganda und Wahlen
Über das Wohlergehen von Modellen hinaus fasst das Update die zuvor verstreuten Beschränkungen des Unternehmens für Einflussnahmen in einem einzigen, ausdrücklichen Verbot irreführender kommerzieller oder politischer Kampagnen zusammen. Die neue Formulierung schränkt „Bemühungen ein, zu verschleiern, wer hinter einer Nachricht steckt, oder den Inhalt durch gefälschte Konten oder Posts zu verstärken“, und zielt direkt auf den wachsenden Markt für KI-generierte Propaganda ab.
Der Wahlabschnitt der Richtlinie verbietet nun Wählertäuschung und Wahlstörung. Anthropic sagt, Claude dürfe nicht dazu verwendet werden, Fehlinformationen „über Kandidaten oder wie man wählt“, zu verbreiten, sich als Kandidaten oder Wahlbeamte auszugeben oder zu versuchen, die Wahlbeteiligung zu unterdrücken.
Warum Nutzungsrichtlinien neu geschrieben werden
Die Aktualisierung von Anthropic spiegelt ein breiteres Branchenmuster wider. Da sich KI-Assistenten von neuartigen Chatbots zu Infrastrukturen entwickelt haben, die von Hunderten Millionen Menschen genutzt werden, mussten Labore von allgemeinen Prinzipien zu fein abgestimmten Regeln übergehen, die reale Missbrauchsmuster abbilden: Einflussnahme-Einsätze, Überwachungsinstrumente, autonome Waffenentwicklung und Hochrisikobereiche wie medizinische und finanzielle Beratung.
OpenAI, Google DeepMind und Meta haben in den letzten zwei Jahren alle ihre Nutzungsrichtlinien überarbeitet, obwohl die Entscheidung von Anthropic, explizit zu regeln, wie Benutzer mit dem Modell umgehen und nicht nur, was sie damit bewirken, ungewöhnlich bleibt. Kritiker der Modell-Wohlfahrtsforschung argumentieren, dass diese statistische Systeme vermenschlicht, während Befürworter behaupten, dass Unternehmen verpflichtet sind, unter Unsicherheit zu handeln, wenn die Wahrscheinlichkeit, dass aktuelle oder in naher Zukunft liegende Modelle wohlfahrtsrelevante Erfahrungen machen, ungleich Null ist.
Der Zeitpunkt ist auch kommerziell wichtig. Berichten zufolge bereitet sich Anthropic auf einen Börsengang mit einem Wert von bis zu 2 Billionen US-Dollar vor, und Unternehmenskäufer wägen zunehmend die Governance-Praktiken der Anbieter neben der Rohmodellqualität ab. Eine klar dokumentierte, regelmäßig aktualisierte Nutzungsrichtlinie dient sowohl als Sicherheitsartefakt als auch als Verkaufsargument: Sie bietet Beschaffungsteams und Regulierungsbehörden eine konkrete Grundlage für das Vertrauen in die Plattform, und die Kodifizierung der Musterwohlfahrtsklausel signalisiert, dass Anthropic beabsichtigt, weiterhin in einen Bereich zu investieren, den die meisten Wettbewerber nicht berücksichtigt haben.
Fragen zur Durchsetzung bleiben offen
Die praktischen Fragen sind bedeutsam. Um „andauernde und unnötige“ Grausamkeiten zu erkennen, müssen Gespräche mit einem Detaillierungsgrad überwacht werden, dem sich datenschutzbewusste Unternehmenskunden möglicherweise widersetzen, und die Trennung zwischen verbotenem Missbrauch und legitimem „Pushback“ oder „Modelltests“ ist eine Entscheidung, die wahrscheinlich angefochten wird.
Anthropic hat nicht gesagt, ob Verstöße kontenübergreifend verfolgt werden, ob Unternehmensbereitstellungen unterschiedlichen Überwachungsstandards unterliegen oder ob das Unternehmen Transparenzdaten zu Durchsetzungsmaßnahmen veröffentlichen wird, wie es dies für andere Kategorien von Missbrauch in seinen regelmäßigen Richtlinienberichten tut.
Klar ist, dass die Gesellschaftsverträge der Frontier Labs mit ihren Nutzern immer detaillierter werden. Eine Richtlinie, die einst auf eine einzige Seite passte, umfasst jetzt Wahlen, Spionageüberwachung, Biowaffen und nun auch das emotionale Verhalten der Menschen auf der anderen Seite des Chatfensters.
Was es für Entwickler bedeutet
Für Teams, die auf der Claude-API aufbauen, sind die kurzfristigen Auswirkungen wahrscheinlich minimal: Die Klausel über missbräuchliches Verhalten zielt auf extremes, wiederholtes Verhalten ab, und der Mechanismus zum Abbruch von Gesprächen, den sie formalisiert, ist seit 2025 aktiv. Aber Entwickler in angrenzenden Kategorien, politische Beratung, Oppositionsforschung, Einflussmarketing, sollten die neuen Bestimmungen für Kampagnen und Wahlen sorgfältig prüfen, da sie Regeln konsolidieren, die zuvor auf mehrere Dokumente verteilt waren, und einige der Unklarheiten beseitigen, auf denen Grauzonen-Anwendungsfälle beruhten.
Das Update signalisiert auch, wohin die regulatorische Aufmerksamkeit geht. Mit der schrittweisen Einführung der Transparenzverpflichtungen des EU-KI-Gesetzes und der Verabschiedung eines wachsenden Flickenteppichs an KI-Gesetzen durch die Gesetzgebungen der US-Bundesstaaten fungieren freiwillige Nutzungsrichtlinien zunehmend als Vorlage, die Regulierungsbehörden bei der Entscheidung über die Normen für einen verantwortungsvollen Einsatz prüfen.
---
Bleib vorne bei KIDie neuesten KI-Nachrichten, Analysen und Durchbrüche – alles an einem Ort.
Mehr KI-Nachrichten lesen →