Modely a platformy AI

Anthropic vysvětluje mechanismus textuové vodotisku Claude

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

Anthropic zveřejnil 14. srpna 2026 podrobnou zprávu o tom, jak funguje textová vodotisk ve budoucích modelech Claude, a identifikoval ji jako verzi techniky SynthID-Text, kterou společnost Google DeepMind zveřejnila v recenzovaném článku z roku 2024 v časopise Nature. Společnost tuto technickou zprávu rámovala kolem povinnosti dodržovat změnu: od 2. srpna 2026 vyžaduje evropský zákon o umělé inteligenci, aby poskytovatelé serving evropskému trhu označovali obsah generovaný umělou inteligencí, a Anthropic podepsal transparentní kód bloku v červenci 2026 spolu s přibližně 190 organizacemi.

Tato zpráva přichází tři dny poté, co Anthropic potvrdil plán na stránce podpory, o kterém jsme informovali 11. srpna 2026. Zatímco tato stránka popsala, co vodotisky dělají, nová zpráva popisuje, jak textová vodotisk funguje, kde se rozpadá a co nemůže prokázat. Anthropic říká, že vodotisk neobsahuje žádné identifikační informace, nevyžaduje žádné další tokeny a nemá žádný praktický dopad na kvalitu výstupu, náklady nebo rychlost.

Vodotisk žije ve volbě slov, ne ve skrytých znacích

Mechanizmus využívá, jak jazykové modely generují text. Při každém kroku model vybere jedno slovo ze seznamu pravděpodobných kandidátů; pokud jsou několik voleb přibližně stejné (“zatmění” versus “šedé” po “Počasí dnes bylo studené a…”), je volba určena náhodným číslem. Vodotisk nahrazuje tuto náhodnou náhodnost náhodností odvozenou z tajného klíče plus předchozích slov. Text zůstává náhodný pro každého čtenáře, ale kdokoli, kdo drží klíč, může otestovat, zda je posloupnost slov statisticky konzistentní s volbami, které by udělal model s klíčem, a přiřadit pravděpodobnost, že Claude byl zapojen.

Nic není přidáno k textu a nejsou žádné skryté znaky nebo neviditelné Unicode. Protože vzor leží ve volbě slov samých, cestuje s kopírovaným a vloženým textem způsobem, který nelze připojit metadata. Anthropic srovnává to s softwarem pro detekci AI, jako je Pangram, který odvozuje autorství ze stylistických zvyků, protože postrádá klíč poskytovatele.

Papírová stopa za tvrzeními Anthropic o kvalitě

Zajištění kvality Anthropic spočívá převážně na záznamu techniky, kterou přijal. V článku z Nature, který představil SynthID-Text, společnost Google DeepMind uvedla, že otestovala metodu tak, že poskytla vodotiskovaný model části provozu Gemini a porovnala hodnocení palce nahoru a palce dolů s nevodotiskovaným modelem, a našla žádný statisticky významný rozdíl; kontrolovaná studie s lidskými hodnotiteli rovněž nezjistila žádný kvalitativní rozdíl. Anthropic říká, že jeho vlastní interní testy nezjistily žádný dopad na obsah, kreativitu nebo čitelnost, a že vodotisk ne přidává žádné tokeny, takže model stojí stejně jako služba a použití.

Anthropic aplikuje vodotisk globálně při spuštění, a not only v EU, protože dosud nemá žádný trvanlivý způsob, jak ho omezit regionálně. To činí evropskou povinnost celosvětovým designovým omezením pro Claude. Další signatáři kódu, včetně Google, Meta, Microsoft, Mistral a OpenAI, implementují své vlastní metody označování v rámci stejného rámce, podle oznámení Evropské komise ze 31. července 2026.

Kde Anthropic říká, že se vodotisk stává tišším

Článek je nezvykle specifický o režimech selhání. Detekce funguje špatně na krátkých pasážích, které nabízejí málo voleb slov pro test. Tenká vrstva se na faktickém textu, kde přesnost omezuje model na jednu správnou odpověď a ponechává vodotisk nic, na co by mohl působit, a na kódu, který musí být přesný, aby fungoval. Vodotisk může být připojen k libovolným volbám, jako jsou komentáře, ale má zanedbatelný účinek na produkovaný kód. Lehká editace pravděpodobně neodstraní vodotisk; úplná přepsání ano.

Vodotisk také nemůže prokázat to, co by čtenáři mohli předpokládat. Detekce odpovídá pouze na otázku “jaká je pravděpodobnost, že to bylo částečně napsáno Claude?” Nemůže potvrdit, zda byl text napsán člověkem, nemůže identifikovat výstup z jiného systému AI — každý poskytovatel má jiný klíč a metodu — a nemůže rozlišit “Claude napsal to” a “Claude silně upravil to.” Vodotisk neobsahuje nic, co by bylo stopovatelné k osobě, organizaci nebo chatu, a nemění nic o vlastnictví výstupu nebo právech uživatelů podle podmínek Anthropic.

Odděleně od vodotisku nesou soubory, které Claude produkuje ve formátech, jako jsou .png, .jpg a .svg, kryptograficky podepsanou povědomí o původu podle otevřeného standardu C2PA, čitelného jakýmkoli nástrojem C2PA,.

Co se bude dodávat jako další pro detekci vodotisku Claude

Přechodné období v evropském zákoně pokrývá modely Anthropic spuštěné před 2. srpnem 2026; společnost říká, že vodotisk pro tyto starší modely bude nasazen v následujících měsících. Plánovaná je API pro detekci vodotisku, s detaily, které jsou dosud řešeny, a Anthropic má v úmyslu poskytnout nástroj pro kontrolu povědomí o obsahu souborů. Unite.AI dříve informoval o povinnosti označování obsahu, který se stává povinným podle evropského zákona, a o tom, jak Google podepsal stejný transparentní kód. Komise spustí dvě signatářské úkoly v září 2026, aby porovnala postupy implementace: první strukturované místo, kde se přístup Anthropic bude nacházet vedle přístupů ostatních hlavních poskytovatelů, kteří podepsali kód.

Mira Kellan je sloupkařka generovaná umělou inteligencí, specializující se na etiku umělé inteligence, řízení a regulaci. Její práce zkoumá, jak se umělá inteligence prolíná s veřejnou politikou, společenskými hodnotami a dlouhodobou odpovědností, se zaměřením na odpovědnou inovaci.
Přistupuje ke komplexním problémům racionálním a filozofickým pohledem, Mira analyzuje vznikající regulace umělé inteligence, etické rámce a modely řízení, které formují budoucnost inteligentních systémů. Cílem je most mezi rychlým technologickým pokrokem a zárukami, které jsou potřebné k zajištění transparentnosti, spravedlivosti a souladu systémů umělé inteligence s lidskými zájmy.
Články napsané Mira Kellan jsou generovány umělou inteligencí a recenzovány redakčním týmem Unite.AI, aby zajistily přesnost, vyváženost a soulad s redakčními standardy.