Modele i platformy AI
Anthropic wyjaśnia mechanizm znakowania wodnego tekstu Claude

Anthropic opublikował szczegółowy opis z dnia 14 sierpnia 2026 r. dotyczący sposobu działania znakowania wodnego w przyszłych modelach Claude, identyfikując go jako wersję techniki SynthID-Text, którą Google DeepMind opublikował w recenzowanym artykule z 2024 r. w czasopiśmie Nature. Spółka przedstawiła wyjaśnienie techniczne wokół obowiązku zgodności za zmianę: od dnia 2 sierpnia 2026 r. Rozporządzenie UE w sprawie sztucznej inteligencji wymaga od dostawców świadczących usługi na rynku europejskim znakowania treści generowanych przez sztuczną inteligencję, a Anthropic podpisał kodeks transparentności UE w lipcu 2026 r. wraz z około 190 organizacjami.
Otwarcie to następuje trzy dni po tym, jak Anthropic potwierdził plan znakowania wodnego na stronie pomocy, o czym informowaliśmy 11 sierpnia 2026 r. Tam, gdzie strona opisywała, co robi znak, nowy post opisuje, jak działa znakowanie tekstu, gdzie się łamie i czego nie może udowodnić. Anthropic twierdzi, że znakowanie nie zawiera żadnych informacji identyfikujących, nie wymaga dodatkowych tokenów i nie ma żadnego praktycznego wpływu na jakość wyjścia, koszt lub szybkość.
Znakowanie wodne żyje w wyborze słów, a nie w ukrytych znakach
Mechanizm wykorzystuje sposób, w jaki modele językowe generują tekst. Na każdym etapie model wybiera jedno słowo z listy prawdopodobnych kandydatów; tam, gdzie kilka wyborów jest mniej więcej równych (“pochmurny” versus “szary” po “Pogoda dzisiaj była zimna i…”), wybór jest ustalany przez losową liczbę. Znakowanie wodne zastępuje tę arbitralną losowość losowością pochodzącą z tajnego klucza plus poprzednich słów. Tekst pozostaje losowy dla każdego czytelnika, ale każdy, kto posiada klucz, może przetestować, czy sekwencja słów jest statystycznie spójna z wyborami, jakie mógłby uczynić model z kluczem, i przypisać prawdopodobieństwo, że Claude był zaangażowany.
Nic nie jest dodawane do tekstu, a nie ma ukrytych znaków ani niewidocznych Unicode. Ponieważ wzorzec znajduje się w samych wyborach słów, podróżuje z kopiowanym i wklejanym tekstem w sposób, w jaki dołączone metadane nie mogą. Anthropic porównuje to z oprogramowaniem do wykrywania sztucznej inteligencji, takim jak Pangram, które wnioskuje o autorstwie z nawyków stylistycznych, ponieważ nie posiada klucza dostawcy.
Papierowy ślad za roszczeniami Anthropic do jakości
Zapewnienia jakości Anthropic opierają się w dużej mierze na rekordzie techniki, którą przyjęli. W artykule Nature wprowadzającym SynthID-Text, Google DeepMind poinformował o przetestowaniu metody przez obsłużenie modelu z znakowaniem wodnym części ruchu Gemini i porównaniu ocen kciuka w górę i w dół z modelem bez znakowania wodnego, nie stwierdzając żadnej statystycznie istotnej różnicy; kontrolowane badanie równoległe z ludzkimi oceniającymi również nie wykazało żadnej luki jakościowej. Anthropic twierdzi, że własne wewnętrzne testy nie wykazują żadnego wpływu na treść, kreatywność ani czytelność, a znakowanie wodne nie dodaje żadnych tokenów, więc model kosztuje tyle samo do obsługi i użycia.
Anthropic stosuje znakowanie wodne na całym świecie przy uruchomieniu, a nie tylko w UE, mówiąc, że nie mają jeszcze trwałego sposobu, aby to ograniczyć do regionu. To sprawia, że europejski obowiązek jest światowym ograniczeniem konstrukcyjnym dla Claude. Inni sygnatariusze kodu, w tym Google, Meta, Microsoft, Mistral i OpenAI, wdrażają własne metody znakowania w ramach tego samego ramy, zgodnie z ogłoszeniem Komisji Europejskiej z dnia 31 lipca 2026 r.
Gdzie Anthropic mówi, że znak staje się cichy
Post jest niezwykle szczegółowy co do trybów awaryjnych. Wykrywanie działa słabo na krótkich fragmentach, które oferują niewiele wyborów słów do testowania. Rozcieńcza się na tekście faktów, gdzie dokładność ogranicza model do jednej prawidłowej odpowiedzi i pozostawia znakowanie wodne nic do działania, i na kodzie, który musi być dokładny, aby działać. Znak może dołączyć do arbitralnych wyborów, takich jak komentarze, ale, zgodnie z projektem, ma znikomy wpływ na wytwarzany kod. Lekka edycja prawdopodobnie nie usunie znakowania wodnego; pełne przepisanie usunie.
Znak również nie może potwierdzić tego, co czytelnicy mogliby założyć, że robi. Wykrywanie odpowiada tylko na pytanie “jaki jest prawdopodobieństwo, że to zostało częściowo napisane przez Claude?” Nie może potwierdzić, że tekst został napisany przez człowieka, nie może zidentyfikować wyjścia z innego systemu sztucznej inteligencji — każdy klucz i metoda dostawcy są różne — i nie może odróżnić “Claude napisał to” od “Claude znacznie edytował to.” Znakowanie wodne nie zawiera nic, co mogłoby być śledzone do osoby, organizacji lub czatu, i nie zmienia niczego w zakresie własności wyjścia lub praw użytkowników zgodnie z warunkami Anthropic.
Odrębnie od znakowania wodnego, pliki wytworzone przez Claude w obsługiwanych formatach, takich jak .png, .jpg i .svg, zawierają kryptograficznie podpisaną poświadczenie pochodzenia zgodnie z otwartym standardem C2PA, czytelnym przez każdy narzędzie zgodne z C2PA.
Co jest następne dla wykrywania znakowania wodnego Claude
Okres przejściowy w prawie UE obejmuje modele Anthropic uruchomione przed dniem 2 sierpnia 2026 r.; spółka twierdzi, że znakowanie wodne dla tych starszych modeli zostanie wdrożone w ciągu najbliższych miesięcy. Planowane jest API do wykrywania znakowania wodnego, a szczegóły wdrożenia są jeszcze opracowywane, a Anthropic zamierza dostarczyć narzędzie do sprawdzania poświadczeń treści plików. Unite.AI wcześniej relacjonował o obowiązku oznaczania treści sztucznej inteligencji, który wchodzi w życie, oraz o tym, że Google podpisał ten sam kodeks transparentności. Biuro ds. Sztucznej Inteligencji Komisji uruchamia dwa zespoły zadaniowe sygnatariuszy we wrześniu 2026 r. w celu porównania praktyk wdrożeniowych: pierwsze sformalizowane miejsce, w którym podejście Anthropic zostanie umieszczone obok podejść innych głównych dostawców, którzy podpisali ten kodeks.












