Dagen nadat Anthropic begon met het uitrollen van onzichtbare watermerken op Claude's tekst- en beelduitvoer, veroorzaakt de functie precies het soort wrijving dat critici voorspelden: gebruikers waren bang dat de markeringen ze zouden blootstellen aan het gebruik van AI op het werk of in de klas, ontwikkelaars documenteerden hoe het watermerk zich gedraagt in echte codeerworkflows, en een kleine maar zichtbare markt van tools die beloven het te verwijderen.
Anthropic zegt dat de verandering Claude in lijn brengt met de AI-wet van de Europese Unie, waarvan de transparantieregels na 2 augustus 2026 afdwingbaar werden voor nieuwe modellen. Artikel 50 van de wet vereist dat aanbieders van AI-systemen door machines gegenereerde output ‘detecteerbaar als kunstmatig gegenereerd’ maken. Anthropic bevestigde dat alle nieuwe modellen die wereldwijd worden aangeboden – en niet alleen in de EU – door AI gegenereerde inhoud “vanaf de eerste dag” zullen markeren, met een uitstelperiode tot december 2026 voor het updaten van eerder uitgebrachte modellen. Voor meer context over dit verhaal, zie ons laatste AI-ontwikkelingen.
De markeringen zelf zijn onzichtbaar. Tekstuitvoer "draagt ingebedde watermerken", terwijl de gegenereerde bestanden digitaal ondertekende metagegevens over de herkomst bevatten, waar het formaat dit ondersteunt, volgens een ondersteuningsartikel van Anthropic. Eerdere Claude-modellen zullen worden bijgewerkt om ook tekst te markeren, wat betekent dat de hele vloot uiteindelijk de uitvoer zal stempelen.
Het watermerk omvat bewerkte tekst, niet alleen gegenereerde tekst
Het detail dat technische nieuwsgierigheid in een tegenreactie veranderde, werd op 13 augustus onthuld door Ars Technica: het watermerk is van toepassing op de inhoud die Claude verwerkt, en niet alleen op de inhoud die het vanuit het niets genereert. Ars typeerde de aanpak als ‘het uit de ruimte halen’, omdat Anthropic alle verwerkte inhoud markeert waar dit wordt ondersteund, ook al vereist de EU-richtlijnen dit niet wanneer een AI-systeem ‘een ondersteunende functie vervult voor standaardbewerking’ – het voorbeeld van de verordening is grammaticacorrectie – of waar het de tekst van een gebruiker niet ‘substantieel verandert’.
Dat onderscheid is van belang omdat een watermerk dat op modelniveau wordt toegepast de grootschalige opwekking niet kan onderscheiden van een kommafix. Ashley Belanger van Ars Technica merkte op dat Claude uiteindelijk precies het soort licht bijgewerkte menselijke schrift zou kunnen stempelen dat de wet met rust wilde laten. In de praktijk markeert het merkteken alles wat Claude verwerkte – zelfs een document dat een mens schreef en Claude alleen vroeg om het op te poetsen.
Gebruikers zijn bang om betrapt te worden op het werk en op school
De reactie van de gebruiker was snel. TechCrunch meldde op 13 augustus dat sommige Claude-gebruikers "boos zijn dat de nieuwe watermerken van Anthropic hen zullen betrappen op het gebruik ervan tijdens hun werk en tijdens lessen." Werknemers die stilletjes op Claude leunen om e-mails, rapporten of slideshows op te stellen – en studenten die het bij opdrachten gebruiken – worden nu geconfronteerd met de mogelijkheid dat een baas of instructeur de betrokkenheid van AI kan verifiëren met een detectietool.
Ars Technica omlijstte de dynamiek als een ‘Scarlet Letter’ – een onzichtbare badge van AI-gebruik die de lezer niet kan zien, maar instellingen binnenkort wel. Omdat het watermerk via kopiëren en plakken en opmaakwijzigingen met de tekst meereist, laat de gebruikelijke verdediging van "Ik heb het net een beetje bewerkt" niet langer de vingerafdrukken van de AI achter.
Er ontstaat al een verhuismarkt
Waar een watermerk is, volgt een verhuisindustrie. SC Media meldde dat er in de dagen na de Claude-update al een markt ontstaat voor tools voor het verwijderen van AI-watermerken. Decrypt documenteerde dat bouwers actief proberen het markeringsschema te doorbreken, door te onderzoeken hoe het zich gedraagt bij parafraseren, vertalen en opnieuw formatteren.
Vroege tests wijzen uit dat het watermerk stevig is tegen ongedwongen gebruik, maar lekt onder professionele omstandigheden. De berichtgeving van The New Stack concludeerde dat het merk "kopiëren en plakken overleeft, maar niet de echte dev-workflow" - wat betekent dat softwareontwikkelaars die door AI voorgestelde code substantieel herwerken als onderdeel van normale engineering, het merk kunnen wegspoelen zonder dat ze dat ooit van plan zijn.
Hoe het merkteken feitelijk werkt
Een breed gedeelde visuele uitleg, gepubliceerd op declaude.org, legt het mechanisme bloot. Tekst heeft geen pixels om gegevens in te verbergen en geen enkele metagegevens overleeft het kopiëren en plakken, dus het watermerk leeft in 'de keuzes tussen woorden'. Zoals een model schrijft, selecteert het herhaaldelijk uit verschillende, even plausibele volgende woorden; een geheime cryptografische sleutel stuurt deze selecties stilletjes naar een patroon dat alleen de sleutelhouder kan detecteren.
De techniek is terug te voeren op onderzoek van Kirchenbauer et al. vanaf 2023, waarbij kandidaatwoorden werden opgesplitst in ‘groene’ en ‘rode’ lijsten en de generatie naar groene tokens werd gekanteld. Google's SynthID bereikt een vergelijkbare bestemming via een subtielere route, en Google heeft sinds 2024 tekst uit de Gemini-app en webervaring van een watermerk voorzien - de API is een gedocumenteerde uitzondering. Vanaf augustus 2026 markeren nieuwe Claude-modellen tekst op modelniveau, en eerdere modellen zullen volgen.
Sceptici zeggen dat verwijdering triviaal blijft
Niet iedereen is ervan overtuigd dat de wapenwedloop in het voordeel van Anthropic is. In een wijd verspreid essay betoogde ingenieur Sean Goedecke dat tekstwatermerken "altijd triviaal zullen zijn om te verwijderen" omdat tekst een extreem gecomprimeerd medium is - elke verandering die sterk genoeg is om een vastberaden verwijdering te overleven, is een verandering die een menselijke lezer zou opmerken. Het parafraseren van hulpmiddelen, vertaalrondjes en het doelbewust herformuleren dreigen allemaal statistische patronen te doorbreken zonder de betekenis te verminderen.
Het debat speelt zich af in ontwikkelaarsgemeenschappen: twee afzonderlijke uitlegprogramma's voor watermerken behoorden tot de meest besproken verhalen op Hacker News deze week, waardoor er honderden punten van overeenkomst tussen hen ontstonden.
Wat gebeurt er vervolgens
Anthropic heeft gezegd dat het uiteindelijk details zal delen over hoe de markeringen kunnen worden gedetecteerd – technische ondersteuning die de EU-regelgeving vereist – maar totdat er een openbaar detectie-instrument wordt uitgebracht, kunnen externe partijen niet verifiëren hoe grondig de markering daadwerkelijk is. Het bedrijf heeft ook erkend dat de watermerken niet zullen werken op "sommige platforms of functies" die deze niet ondersteunen.
Nu oudere modellen te maken krijgen met een nalevingsdeadline van december 2026 en rivaliserende laboratoria toekijken of gebruikers Anthropic straffen voor transparantie, zullen de komende maanden een voorstel testen dat de industrie al jaren heeft vermeden: of AI-aanbieders hun output traceerbaar kunnen maken zonder het giftig te maken voor de mensen die erop vertrouwen.
---
Blijf Voorop met AIHet laatste AI-nieuws, analyses en doorbraken — allemaal op één plek.
Lees meer AI-nieuws →