AI-modellen en platforms

Anthropic Legt de Mechanismen van Claude’s Tekstwatermerk Uit

mm
Voeg Unite.AI toe aan je voorkeursbronnen op Google

Anthropic publiceerde op 14 augustus 2026 een gedetailleerd verslag over hoe het tekstwatermerk in toekomstige Claude-modellen werkt, waarbij het een versie van de SynthID-Text-techniek noemt die Google DeepMind in een peer-reviewed artikel in Nature uit 2024 publiceerde. Het bedrijf plaatste de technische verklaring in de context van de nalevingsverplichting achter de verandering: vanaf 2 augustus 2026 vereist de EU-AI-wetgeving van aanbieders die de Europese markt bedienen om gegenereerde AI-inhoud te markeren, en Anthropic ondertekende de transparantiecode van de EU in juli 2026, samen met ongeveer 190 organisaties.

De openbaarmaking komt drie dagen na de bevestiging door Anthropic van het watermerkplan op een ondersteuningspagina, die hier op 11 augustus 2026 werd besproken. Waar die pagina beschreef wat de markeringen doen, beschrijft het nieuwe artikel hoe het tekstmerk werkt, waar het breekt en wat het niet kan bewijzen. Anthropic zegt dat het watermerk geen identificerende informatie bevat, geen extra tokens vereist en geen praktisch effect heeft op de kwaliteit van de uitvoer, de kosten of de snelheid.

Het Watermerk Leeft in Woordkeuze, Niet in Verborgen Tekens

Het mechanisme maakt gebruik van de manier waarop taalmodellen tekst genereren. Bij elke stap kiest een model een woord uit een lijst van plausibele kandidaten; waar meerdere keuzes ongeveer gelijk zijn (“overcast” versus “grijs” na “Het weer vandaag was koud en…”), wordt de keuze bepaald door een willekeurig getal. Watermerken vervangen die willekeurige willekeur door willekeur die afgeleid is van een geheime sleutel plus de voorgaande woorden. De tekst blijft willekeurig voor elke lezer, maar iedereen die de sleutel heeft, kan testen of een reeks woorden statistisch consistent is met de keuzes die een gemarkeerd model zou maken, en een waarschijnlijkheid toewijzen dat Claude betrokken was.

Er wordt niets aan de tekst toegevoegd en er zijn geen verborgen tekens of onzichtbare Unicode. Omdat het patroon in de woordkeuzes zelf zit, reist het met gekopieerde en geplakte tekst op een manier die niet mogelijk is met bijgevoegde metadata. Anthropic contrasteert dit met AI-detectiesoftware zoals Pangram, die auteursschap afleidt uit stijlkenmerken omdat het geen enkele providersleutel heeft.

Het Papieren Spoor Achter Anthropic’s Kwaliteitsclaims

Anthropic’s kwaliteitsgaranties berusten grotendeels op het record van de techniek die het heeft overgenomen. In het Nature-artikel waarin SynthID-Text werd geïntroduceerd, meldde Google DeepMind dat het de methode had getest door een gemarkeerd model aan te bieden aan een deel van het Gemini-verkeer en de duimomhoog- en duimomlaagbeoordelingen te vergelijken met het ongemarkeerde model, zonder statistisch significante verschillen te vinden; een gecontroleerde zij-aan-zij-studie met menselijke beoordelaars vond evenmin een kwaliteitsgap. Anthropic zegt dat zijn eigen interne tests geen invloed op inhoud, creativiteit of leesbaarheid laten zien, en dat watermerken geen tokens toevoegen, zodat het model even duur is om aan te bieden en te gebruiken.

Anthropic past het watermerk wereldwijd toe bij de lancering, in plaats van alleen in de EU, omdat het nog geen duurzame manier heeft om het te beperken tot een regio. Dat maakt de Europese verplichting een wereldwijde ontwerpeis voor Claude. Andere ondertekenaars van de code, waaronder Google, Meta, Microsoft, Mistral en OpenAI, implementeren hun eigen markeringmethoden onder hetzelfde kader, zoals aangekondigd door de Europese Commissie op 31 juli 2026.

Waar Anthropic Zegt dat de Markering Stil Valt

Het artikel is ongebruikelijk specifiek over foutmodi. Detectie werkt slecht op korte passages, die weinig woordkeuzes bieden om te testen. Het valt dun uit op feitelijke tekst, waar precisie het model dwingt tot één juist antwoord en de watermerking niets te doen geeft, en op code, die exact moet zijn om te draaien. De markering kan zich hechten aan willekeurige keuzes zoals opmerkingen, maar heeft, door ontwerp, een verwaarloosbaar effect op de gegenereerde code. Een lichte bewerking zal de watermerking waarschijnlijk niet verwijderen; een volledige herschrijving wel.

De markering kan evenmin bewijzen wat lezers ervan zouden verwachten. Een detectie beantwoordt alleen de vraag “wat is de waarschijnlijkheid dat dit deels door Claude is geschreven?” Het kan niet bevestigen dat de tekst door een mens is geschreven, kan de uitvoer van een ander AI-systeem niet identificeren — elke providersleutel en methode zijn verschillend — en kan niet onderscheiden tussen “Claude schreef dit” en “Claude bewerkte dit zwaar”. De watermerking bevat niets dat terug te voeren is op een persoon, organisatie of chat, en het verandert niets aan de eigendom van de uitvoer of de rechten van gebruikers onder de voorwaarden van Anthropic.

Afgezien van de watermerking, dragen bestanden die Claude produceert in ondersteunde formaten zoals .png, .jpg en .svg een cryptografisch ondertekend provenance-credential onder de open C2PA-standaard, leesbaar door elk C2PA-georiënteerd hulpmiddel.

Wat Komt Er Hierna voor Claude’s Watermerkdetectie

De overgangsperiode in de EU-wetgeving dekt Anthropic-modellen die zijn gelanceerd vóór 2 augustus 2026; het bedrijf zegt dat watermerking voor die oudere modellen in de komende maanden zal worden uitgerold. Een watermerkdetectie-API is gepland, met implementatiedetails die nog worden uitgewerkt, en Anthropic heeft de intentie om een hulpmiddel te bieden voor het controleren van de inhoudsreferenties van bestanden. Unite.AI heeft eerder het verplichte labelvereiste en Google ondertekende dezelfde transparantiecode. De AI-kantoor van de Commissie lanceert twee ondertekeningswerkgroepen in september 2026 om de implementatiepraktijken te vergelijken: de eerste gestructureerde locatie waar de aanpak van Anthropic naast die van de andere grote aanbieders zal staan die de code hebben ondertekend.

Mira Kellan is een AI-gegenereerde columnist die zich specialiseert in AI-ethiek, governance en regulering. Haar werk onderzoekt hoe kunstmatige intelligentie samenkomt met publieke beleid, maatschappelijke waarden en langetermijnverantwoordelijkheid, met een focus op verantwoorde innovatie.
Ze benadert complexe kwesties met een rationele en filosofische lens, Mira analyseert opkomende AI-reguleringen, ethische kaders en governance-modellen die de toekomst van intelligente systemen vormgeven. Ze streeft ernaar om de kloof te overbruggen tussen snelle technologische vooruitgang en de waarborgen die nodig zijn om ervoor te zorgen dat AI-systemen transparant, eerlijk en afgestemd zijn op menselijke belangen.
Artikelen geschreven door Mira Kellan zijn AI-gegenereerd en worden beoordeeld door het redactionele team van Unite.AI om accuratesse, evenwicht en naleving van redactionele normen te waarborgen.