Моделі та платформи ШІ
Антропік пояснює механіку водяного знака тексту Клода

Антропік опублікував детальний звіт 14 серпня 2026 року про те, як працює водяний знак тексту в майбутніх моделях Клода, ідентифікуючи його як версію техніки SynthID-Text, опублікованої Google DeepMind у рецензованій статті 2024 року в Nature. Компанія представила технічний звіт у контексті зобов’язання з дотримання законодавства: з 2 серпня 2026 року законодавство ЄС про штучний інтелект вимагає від постачальників, які обслуговують європейський ринок, маркувати контент, створений штучним інтелектом, і Антропік підписав кодекс прозорості ЄС у липні 2026 року разом з приблизно 190 організаціями.
Ця публікація з’явилася через три дні після того, як Антропік підтвердив плани щодо водяного знака на сторінці підтримки, про яку ми повідомили 11 серпня 2026 року. Якщо на тій сторінці описувалося, що роблять ці знаки, нова публікація описує, як працює текстовий знак, де він втрачає свою ефективність і що він не може довести. Антропік зазначає, що водяний знак не містить жодної ідентифікуючої інформації, не вимагає додаткових токенів і не має практичного впливу на якість виводу, вартість або швидкість.
Водяний знак існує у виборі слів, а не в прихованих символах
Механізм використовує те, як моделі мови генерують текст. На кожному етапі модель вибирає одне слово з переліку правдоподібних кандидатів; якщо кілька виборів приблизно рівні (“хмарно” проти “сірого” після “Погода сьогодні була холодною і…”), вибір визначається випадковим числом. Водяний знак заміняє цю довільну випадковість на випадковість, отриману з секретного ключа плюс попередні слова. Текст залишається випадковим для будь-якого читача, але будь-хто, хто володіє ключем, може перевірити, чи є послідовність слів статистично сумісною з вибором, який би зробила модель з ключем, і призначити ймовірність того, що Клод був залучений.
Нічого не додається до тексту, і немає прихованих символів або невидимих юнікод-символів. Через те, що шаблон лежить у самих словах, він супроводжує текст, скопійований і вставлений, тим чином, яким прикріплена метадані не можуть. Антропік порівнює це з програмним забезпеченням для виявлення штучного інтелекту, таким як Pangram, яке виводить авторство з стилістичних звичок, оскільки воно не має жодного ключа постачальника.
Документальна основа для тверджень Антропіка про якість
Гарантії якості Антропіка ґрунтуються в основному на досвіді прийнятої ними техніки. У статті Nature, яка представила SynthID-Text, Google DeepMind повідомила про тестування цього методу шляхом надання моделі з водяним знаком частині трафіку Gemini та порівняння рейтингів “подобається” і “не подобається” з немаркованою моделлю, не виявивши статистично значимої різниці; контрольоване дослідження з людськими оцінювачами також не виявило різниці у якості. Антропік зазначає, що власне внутрішнє тестування не виявило жодного впливу на контент, креативність або читабельність, і що водяний знак не додає жодних токенів, тому модель коштує однаково для обслуговування та використання.
Антропік застосовує водяний знак глобально при запуску, а не тільки в ЄС, зазначаючи, що поки що не має стійкого способу обмежити його регіоном. Це робить європейське зобов’язання глобальним обмеженням дизайну для Клода. Інші підписанти кодексу, включаючи Google, Meta, Microsoft, Mistral та OpenAI, реалізують自己的 методи маркування згідно з тим же законодавством, згідно з оголошенням Європейської комісії від 31 липня 2026 року.
Де Антропік каже, що знак стає тихим
Публікація надзвичайно конкретна щодо режимів відмов. Виявлення працює погано на коротких пасажах, які пропонують небагато вибірів слів для тестування. Воно втрачає свою ефективність на фактичному тексті, де точність обмежує модель одним правильним答案ом і залишає водяний знак без дії, і на коді, який повинен бути точним, щоб запуститися. Знак може прикріпитися до довільних виборів, таких як коментарі, але за проектом має незначний вплив на вироблений код. Легкий редагування, ймовірно, не видалить водяний знак; повна переписування видалить.
Знак також не може довести того, що читачі могли б припустити. Виявлення відповідає тільки на питання “яка ймовірність того, що це було частково написано Клодом?” Воно не може підтвердити, що текст був написаний людиною, не може ідентифікувати вивід іншого системи штучного інтелекту — кожен постачальник має свій ключ і метод — і не може розрізняти “Клод написав це” і “Клод сильно редагував це.” Водяний знак не містить жодної інформації, яку можна простежити до особи, організації чи чату, і він нічого не змінює щодо власності на вивід чи прав користувачів згідно з умовами Антропіка.
Відокремлено від водяного знака, файли, які Клод створює у підтримуваних форматах, таких як .png, .jpg та .svg, містять криптографічний підпис про походження згідно з відкритим стандартом C2PA, який можна прочитати будь-яким інструментом, що підтримує C2PA.
Що очікується далі для виявлення водяного знака Клода
Перехідний період у законодавстві ЄС охоплює моделі Антропіка, запущені до 2 серпня 2026 року; компанія заявляє, що водяний знак для цих старих моделей буде розгорнутий у найближчі місяці. Планується API для виявлення водяного знака, а деталі реалізації ще розробляються, і Антропік має намір надати інструмент для перевірки свідчень про контент файлів. Unite.AI раніше повідомляла про обов’язкове позначення контенту, створеного штучним інтелектом, яке набуває чинності, та про підписання Google кодексу прозорості ЄС. Офіс штучного інтелекту Комісії запускає дві групи підписантів у вересні 2026 року для порівняння практик реалізації: перша структурована платформа, де підхід Антропіка буде представлений поряд з підходами інших великих постачальників, які підписали код.












