AI-modeller og plattformer

Anthropic forklarer mekanismen bak Claudes tekstvannmerke

mm
Legg til Unite.AI blant dine foretrukne kilder på Google

Anthropic publiserte en detaljert beskrivelse 14. august 2026 om hvordan tekstvannmerket i fremtidige Claude-modeller fungerer, og identifiserer det som en versjon av SynthID-Text-teknikken som Google DeepMind publiserte i en peer-reviewed 2024 Nature-artikkel. Selskapet rammet den tekniske forklaringen rundt plikten til å etterkomme endringen: fra og med 2. august 2026, krever EU AI-loven at leverandører som betjener det europeiske markedet merker AI-generert innhold, og Anthropic undertegnet blokkens gjennomsiktighetskode i juli 2026 sammen med omtrent 190 organisasjoner.

Avgjørelsen kommer tre dager etter at Anthropic bekreftet vannmerkeplanen på en støtteside, omtalt her 11. august 2026. Der hvor siden beskrev hva merkene gjør, beskriver den nye artikkelen hvordan tekstmerket fungerer, hvor det bryter sammen, og hva det ikke kan bevise. Anthropic sier at vannmerket ikke inneholder noen identifiserbar informasjon, krever ingen ekstra token, og har ingen praktisk innvirkning på utgangskvalitet, kostnad eller hastighet.

Vannmerket lever i ordvalg, ikke i skjulte tegn

Mekanismen utnytter hvordan språkmodeller genererer tekst. På hvert trinn velger en modell ett ord fra en liste over mulige kandidater; der flere valg er omtrent like (“overcast” versus “grey” etter “Været i dag var kaldt og…”), avgjøres valget av et tilfeldig tall. Vannmerking erstatter denne tilfeldige tilfeldigheten med tilfeldighet som er avledet fra en hemmelig nøkkel pluss de foregående ordene. Teksten forblir tilfeldig for enhver leser, men enhver som har nøkkelen kan teste om en sekvens av ord er statistisk konsistent med valgene en nøkkelmodell ville gjøre, og tildele en sannsynlighet for at Claude var involvert.

Ingenting legges til teksten, og det finnes ingen skjulte tegn eller usynlige Unicode. Fordi mønsteret sitter i ordvalgene selv, reiser det med kopierte og limte tekster på en måte som attached metadata ikke kan. Anthropic kontrasterer dette med AI-oppdaggingsprogramvare som Pangram, som antar forfatterskap fra stilistiske vaner fordi den mangler noen leverandørs nøkkel.

Papirsporet bak Anthropics kvalitetskrav

Anthropics kvalitetsgarantier hviler i stor grad på rekorden til teknikken det tok til. I Nature-artikkelen som innførte SynthID-Text, rapporterte Google DeepMind at de testet metoden ved å betjene en vannmerket modell til en del av Gemini-trafikken og sammenlignet tummer opp og tummer ned-ratings mot den uvannmerkede modellen, og fant ingen statistisk signifikant forskjell; en kontrollert side-ved-side-studie med menneskelige vurderinger fant heller ingen kvalitetsgap. Anthropic sier at deres egne interne tester viser ingen innvirkning på innhold, kreativitet eller lesbarhet, og at vannmerking ikke legger til noen token, så modellen koster det samme å betjene og bruke.

Anthropic anvender vannmerket globalt ved lansering i stedet for bare i EU, og sier at de ennå ikke har en varig måte å avgrense det etter region. Dette gjør den europeiske forpliktelsen til en global designbegrensning for Claude. Andre kode-undertegnere, inkludert Google, Meta, Microsoft, Mistral og OpenAI, implementerer sine egne merkingmetoder under samme rammeverk, ifølge Europakommisjonens annonsering 31. juli 2026.

Hvor Anthropic sier at merket blir stille

Artikkelen er usedvanlig spesifik om feilmoduser. Oppdaging fungerer dårlig på korte passasjer, som tilbyr få ordvalg å teste. Den tynner ut på faktisk tekst, hvor nøyaktighet begrenser modellen til ett riktig svar og lar vannmerket intet å handle på, og på kode, som må være nøyaktig for å kjøre. Merket kan feste til tilfeldige valg som kommentarer, men har, ved design, en ubetydelig effekt på den produserte koden. En lett redigering vil sannsynligvis ikke fjerne et vannmerke; en fullstendig omskrivning vil.

Merket kan heller ikke etablere hva lesere kanskje antar det gjør. En oppdaging svarer bare på spørsmålet “hva er sannsynligheten for at dette ble delvis skrevet av Claude?” Det kan ikke bekrefte at teksten var skrevet av en menneske, kan ikke identifisere utgang fra et annet AI-system — hver leverandørs nøkkel og metode er forskjellig — og kan ikke skille “Claude skrev dette” fra “Claude redigerte dette kraftig”. Vannmerket inneholder intet som kan spores til en person, organisasjon eller samtale, og det endrer intet om utgangseierskap eller brukeres rettigheter under Anthropics vilkår.

Uavhengig av vannmerket bærer filer som Claude produserer i støttede formater som .png, .jpg og .svg en kryptografisk signert proveniensbevis under den åpne C2PA-standarden, lesbar av enhver C2PA-bevisst verktøy.

Hva skjer neste for Claudes vannmerkeoppdaging

Overgangsperioden i EU-loven dekker Anthropic-modeller lansert før 2. august 2026; selskapet sier at vannmerking for disse eldre modellene vil rulle ut over de kommende månedene. En vannmerkeoppdaging-API er planlagt, med implementeringsdetaljer som ennå er under arbeid, og Anthropic har til hensikt å tilby et verktøy for å sjekke filers innholdskredensialer. Unite.AI dekket tidligere den obligatoriske merkingplikten som trådte i kraft og Google undertegnet den samme gjennomsiktighetskoden. Kommisjonens AI-kontor lanserer to undertegneroppgaver i september 2026 for å sammenligne implementeringspraksis: det første strukturerte stedet hvor Anthropics tilnærming vil sitte sammen med de andre store leverandørene som undertegnet koden.

Mira Kellan er en AI-generert spaltist som spesialiserer seg på AI-etik, styring og regulering. Hennes arbeid undersøker hvordan kunstig intelligens krysser offentlig politikk, samfunnsverdier og langsiktig ansvar, med fokus på ansvarlig innovasjon.
Hun nærmer seg komplekse problemer med en rasjonell og filosofisk linse, Mira analyserer fremvoksende AI-reguleringer, etiske rammer og styringsmodeller som former fremtiden for intelligente systemer. Hun har som mål å brygge gapet mellom rask teknologisk fremgang og de sikkerhetstiltakene som er nødvendige for å sikre at AI-systemer forblir transparente, rettferdige og i samsvar med menneskelige interesser.
Artikler skrevet av Mira Kellan er AI-generert og gjennomgått av Unite.AIs redaksjonelle team for å sikre nøyaktighet, balanse og overholdelse av redaksjonelle standarder.