Dagar efter att Anthropic började rulla ut osynliga vattenstämplar på Claudes text- och bildutgångar, genererar funktionen exakt den typ av friktion som kritiker förutspått: användare oroade sig för att märkena kommer att exponera dem för att använda AI på jobbet eller i klassen, utvecklare som dokumenterar hur vattenstämpeln beter sig i riktiga kodningsarbetsflöden, och en liten men synlig marknad med verktyg som lovar.

Anthropic säger att förändringen för Claude i linje med EU:s AI-lag, vars öppenhetsregler blev verkställbara för nya modeller efter den 2 augusti 2026. Artikel 50 i lagen kräver att AI-systemleverantörer gör maskingenererade utdata "detekterbara som artificiellt genererade". Anthropic bekräftade att alla nya modeller som erbjuds globalt – inte bara i EU – kommer att markera AI-genererat innehåll "från dag ett", med en respitperiod till december 2026 för uppdatering av tidigare släppta modeller. For more context on this story, see our ongoing AI news.

Märkena i sig är osynliga. Textutdata "bär inbäddade vattenstämplar", medan genererade filer inkluderar digitalt signerad härkomstmetadata där formatet stöder det, enligt en antropisk supportartikel. Tidigare Claude-modeller kommer att uppdateras för att även markera text, vilket innebär att hela flottan så småningom kommer att stämpla sin produktion.

Vattenstämpeln täcker redigerad text, inte bara genererad text

Detaljen som förvandlade teknisk nyfikenhet till en motreaktion avslöjades av Ars Technica den 13 augusti: vattenstämpeln gäller innehåll som Claude bearbetar, inte bara innehåll som det genererar från grunden. Ars karakteriserade tillvägagångssättet som "nuke it from orbit", eftersom Anthropic markerar allt bearbetat innehåll där det stöds även om EU:s egen vägledning inte kräver det där ett AI-system utför "en assisterande funktion för standardredigering" - förordningens exempel är grammatikkorrigering - eller där det inte "väsentligt ändrar" en användares text.

Den distinktionen är viktig eftersom en vattenstämpel som tillämpas på modellnivå inte kan skilja grossistgenerering från en kommafix. Ars Technicas Ashley Belanger noterade att Claude kan sluta med att stämpla exakt den typ av lätt berörd mänsklig skrift som lagen skrevs för att lämna ifred. I praktiken flaggar märket allt som Claude bearbetat - även ett dokument som en människa skrev och bara bad Claude att polera.

Användare fruktar att bli fångad på jobbet och i skolan

Användarreaktionen har varit snabb. TechCrunch rapporterade den 13 augusti att vissa Claude-användare "är galna över att Anthropics nya vattenstämplar kommer att fånga dem använda det på sina jobb, lektioner." Anställda som tyst lutar sig mot Claude för att skriva e-postmeddelanden, rapporter eller bildspel – och studenter som använder det på uppdrag – står nu inför möjligheten att en chef eller instruktör kan verifiera AI-inblandning med ett upptäcktsverktyg.

Ars Technica ramade in dynamiken som ett "Scarlet Letter" - ett osynligt märke för AI-användning som läsaren inte kan se men institutioner snart kan göra det. Eftersom vattenstämpeln färdas med texten genom copy-paste och formatändringar lämnar det vanliga försvaret av "Jag just redigerade det lite" inte längre AI:s fingeravtryck bakom sig.

En flyttmarknad håller redan på att växa fram

Där det finns ett vattenstämpel följer en flyttindustri. SC Media rapporterade att en marknad för verktyg för borttagning av AI-vattenstämplar redan växer fram under dagarna efter Claude-uppdateringen. Dekryptera dokumenterade att byggare aktivt försöker bryta märkningsschemat och undersöka hur det beter sig under parafrasering, översättning och omformatering.

Tidiga tester tyder på att vattenstämpeln är robust mot tillfällig hantering men läcker under professionella förhållanden. The New Stacks bevakning drog slutsatsen att märket "överlever copy-paste, men inte det verkliga dev-arbetsflödet" - vilket innebär att mjukvaruutvecklare som väsentligt omarbetar AI-föreslagen kod som en del av normal teknik kan tvätta bort märket utan att någonsin ha för avsikt att göra det.

Hur märket faktiskt fungerar

En allmänt delad visuell förklarare publicerad på declaude.org bryter ner mekanismen. Text har inga pixlar att dölja data i och ingen metadata överlever copy-paste, så vattenstämpeln lever i "valen mellan ord." Som en modell skriver väljer den gång på gång bland flera lika rimliga nästa ord; en hemlig kryptografisk nyckel fördomar tyst dessa val mot ett mönster som endast nyckelinnehavaren kan upptäcka.

Tekniken spåras till forskning av Kirchenbauer et al. från 2023, som delade upp kandidatord i "gröna" och "röda" listor och lutade genereringen mot gröna tokens. Googles SynthID når en liknande destination via en mer subtil väg, och Google har vattenmärkt text från Gemini-appen och webbupplevelsen sedan 2024 - dess API har varit ett dokumenterat undantag. Från och med augusti 2026 markerar nya Claude-modeller text på modellnivå, med tidigare modeller som kommer att följa.

Skeptiker säger att borttagning förblir trivialt

Alla är inte övertygade om att kapprustningen gynnar Anthropic. I en brett spridd essä hävdade ingenjören Sean Goedecke att textvattenstämplar "alltid kommer att vara triviala att ta bort" eftersom text är ett extremt komprimerat medium - varje förändring som är stark nog att överleva en bestämd borttagning är en förändring som en mänsklig läsare skulle märka. Parafrasering av verktyg, översättningsresor och avsiktlig omformulering hotar alla att skrubba statistiska mönster utan att förnedra betydelsen.

Debatten utspelar sig i utvecklargemenskaper: två separata vattenmärkningsförklarare rankas bland de mest diskuterade berättelserna på Hacker News den här veckan, och drar hundratals engagemang mellan dem.

Vad händer härnäst

Anthropic har sagt att de så småningom kommer att dela detaljer om hur man upptäcker märkena - tekniskt stöd som EU-förordningen kräver - men tills ett offentligt detekteringsverktyg skickas kan externa parter inte verifiera hur noggrann märkningen faktiskt är. Företaget har också erkänt att vattenstämplarna inte kommer att fungera på "vissa plattformar eller funktioner" som inte stöder dem.

Med äldre modeller som står inför en deadline för efterlevnad i december 2026 och rivaliserande laboratorier som tittar för att se om användare straffar Anthropic för transparens, kommer de närmaste månaderna att testa ett förslag som branschen har undvikit i flera år: om AI-leverantörer kan göra sin produktion spårbar utan att göra den giftig för de människor som litar på den.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →