AI-modellen en platforms
Anthropic Legt de Mechanismen van Claude’s Tekstwatermerk Uit

Anthropic publiceerde op 14 augustus 2026 een gedetailleerd verslag over hoe het tekstwatermerk in toekomstige Claude-modellen werkt, waarbij het een versie van de SynthID-Text-techniek noemt die Google DeepMind in een peer-reviewed artikel in Nature uit 2024 publiceerde. Het bedrijf plaatste de technische verklaring in de context van de nalevingsverplichting achter de verandering: vanaf 2 augustus 2026 vereist de EU-AI-wetgeving van aanbieders die de Europese markt bedienen om gegenereerde AI-inhoud te markeren, en Anthropic ondertekende de transparantiecode van de EU in juli 2026, samen met ongeveer 190 organisaties.
De openbaarmaking komt drie dagen na de bevestiging door Anthropic van het watermerkplan op een ondersteuningspagina, die hier op 11 augustus 2026 werd besproken. Waar die pagina beschreef wat de markeringen doen, beschrijft het nieuwe artikel hoe het tekstmerk werkt, waar het breekt en wat het niet kan bewijzen. Anthropic zegt dat het watermerk geen identificerende informatie bevat, geen extra tokens vereist en geen praktisch effect heeft op de kwaliteit van de uitvoer, de kosten of de snelheid.
Het Watermerk Leeft in Woordkeuze, Niet in Verborgen Tekens
Het mechanisme maakt gebruik van de manier waarop taalmodellen tekst genereren. Bij elke stap kiest een model een woord uit een lijst van plausibele kandidaten; waar meerdere keuzes ongeveer gelijk zijn (“overcast” versus “grijs” na “Het weer vandaag was koud en…”), wordt de keuze bepaald door een willekeurig getal. Watermerken vervangen die willekeurige willekeur door willekeur die afgeleid is van een geheime sleutel plus de voorgaande woorden. De tekst blijft willekeurig voor elke lezer, maar iedereen die de sleutel heeft, kan testen of een reeks woorden statistisch consistent is met de keuzes die een gemarkeerd model zou maken, en een waarschijnlijkheid toewijzen dat Claude betrokken was.
Er wordt niets aan de tekst toegevoegd en er zijn geen verborgen tekens of onzichtbare Unicode. Omdat het patroon in de woordkeuzes zelf zit, reist het met gekopieerde en geplakte tekst op een manier die niet mogelijk is met bijgevoegde metadata. Anthropic contrasteert dit met AI-detectiesoftware zoals Pangram, die auteursschap afleidt uit stijlkenmerken omdat het geen enkele providersleutel heeft.
Het Papieren Spoor Achter Anthropic’s Kwaliteitsclaims
Anthropic’s kwaliteitsgaranties berusten grotendeels op het record van de techniek die het heeft overgenomen. In het Nature-artikel waarin SynthID-Text werd geïntroduceerd, meldde Google DeepMind dat het de methode had getest door een gemarkeerd model aan te bieden aan een deel van het Gemini-verkeer en de duimomhoog- en duimomlaagbeoordelingen te vergelijken met het ongemarkeerde model, zonder statistisch significante verschillen te vinden; een gecontroleerde zij-aan-zij-studie met menselijke beoordelaars vond evenmin een kwaliteitsgap. Anthropic zegt dat zijn eigen interne tests geen invloed op inhoud, creativiteit of leesbaarheid laten zien, en dat watermerken geen tokens toevoegen, zodat het model even duur is om aan te bieden en te gebruiken.
Anthropic past het watermerk wereldwijd toe bij de lancering, in plaats van alleen in de EU, omdat het nog geen duurzame manier heeft om het te beperken tot een regio. Dat maakt de Europese verplichting een wereldwijde ontwerpeis voor Claude. Andere ondertekenaars van de code, waaronder Google, Meta, Microsoft, Mistral en OpenAI, implementeren hun eigen markeringmethoden onder hetzelfde kader, zoals aangekondigd door de Europese Commissie op 31 juli 2026.
Waar Anthropic Zegt dat de Markering Stil Valt
Het artikel is ongebruikelijk specifiek over foutmodi. Detectie werkt slecht op korte passages, die weinig woordkeuzes bieden om te testen. Het valt dun uit op feitelijke tekst, waar precisie het model dwingt tot één juist antwoord en de watermerking niets te doen geeft, en op code, die exact moet zijn om te draaien. De markering kan zich hechten aan willekeurige keuzes zoals opmerkingen, maar heeft, door ontwerp, een verwaarloosbaar effect op de gegenereerde code. Een lichte bewerking zal de watermerking waarschijnlijk niet verwijderen; een volledige herschrijving wel.
De markering kan evenmin bewijzen wat lezers ervan zouden verwachten. Een detectie beantwoordt alleen de vraag “wat is de waarschijnlijkheid dat dit deels door Claude is geschreven?” Het kan niet bevestigen dat de tekst door een mens is geschreven, kan de uitvoer van een ander AI-systeem niet identificeren — elke providersleutel en methode zijn verschillend — en kan niet onderscheiden tussen “Claude schreef dit” en “Claude bewerkte dit zwaar”. De watermerking bevat niets dat terug te voeren is op een persoon, organisatie of chat, en het verandert niets aan de eigendom van de uitvoer of de rechten van gebruikers onder de voorwaarden van Anthropic.
Afgezien van de watermerking, dragen bestanden die Claude produceert in ondersteunde formaten zoals .png, .jpg en .svg een cryptografisch ondertekend provenance-credential onder de open C2PA-standaard, leesbaar door elk C2PA-georiënteerd hulpmiddel.
Wat Komt Er Hierna voor Claude’s Watermerkdetectie
De overgangsperiode in de EU-wetgeving dekt Anthropic-modellen die zijn gelanceerd vóór 2 augustus 2026; het bedrijf zegt dat watermerking voor die oudere modellen in de komende maanden zal worden uitgerold. Een watermerkdetectie-API is gepland, met implementatiedetails die nog worden uitgewerkt, en Anthropic heeft de intentie om een hulpmiddel te bieden voor het controleren van de inhoudsreferenties van bestanden. Unite.AI heeft eerder het verplichte labelvereiste en Google ondertekende dezelfde transparantiecode. De AI-kantoor van de Commissie lanceert twee ondertekeningswerkgroepen in september 2026 om de implementatiepraktijken te vergelijken: de eerste gestructureerde locatie waar de aanpak van Anthropic naast die van de andere grote aanbieders zal staan die de code hebben ondertekend.












