Модели и платформы ИИ

Антропик объясняет механику водяного знака текста Клода

mm
Добавьте Unite.AI в избранные источники в Google

Антропик опубликовал подробный отчет 14 августа 2026 года о том, как работает водяной знак текста в будущих моделях Клода, определив его как версию техники SynthID-Text, которую Google DeepMind опубликовал в рецензируемой статье Nature 2024 года. Компания обрамила техническое объяснение вокруг обязательства по соблюдению изменений: с 2 августа 2026 года Закон ЕС об ИИ требует от поставщиков, обслуживающих европейский рынок, маркировать контент, сгенерированный ИИ, и Антропик подписал кодекс прозрачности ЕС в июле 2026 года вместе с примерно 190 организациями.

Раскрытие происходит через три дня после того, как Антропик подтвердил план по водяным знакам на странице поддержки, освещенном здесь 11 августа 2026 года. В то время как эта страница описывала, что делают знаки, новая статья описывает, как работает текстовый знак, где он разбивается и что он не может доказать. Антропик говорит, что водяной знак не содержит никакой идентифицирующей информации, не требует дополнительных токенов и не имеет практического влияния на качество, стоимость или скорость.

Водяной знак живет в выборе слов, а не в скрытых символах

Механизм использует то, как языковые модели генерируют текст. На каждом шаге модель выбирает одно слово из списка правдоподобных кандидатов; где несколько вариантов примерно равны (“облачный” против “серого” после “Погода сегодня была холодной и…”), выбор определяется случайным числом. Водяной знак заменяет эту произвольную случайность на случайность, полученную из секретного ключа плюс предыдущие слова. Текст остается случайным для любого читателя, но любой, кто имеет ключ, может проверить, является ли последовательность слов статистически согласованной с выбором, который сделала бы модель с ключом, и присвоить вероятность того, что Клод был задействован.

Ничего не добавляется к тексту, и нет скрытых символов или невидимых юникод-символов. Поскольку узор находится в самих выборах слов, он передается вместе с текстом, скопированным и вставленным, способом, которым нельзя прикрепить метаданные. Антропик противопоставляет это программному обеспечению для обнаружения ИИ, такому как Pangram, которое выводит авторство из стилевых привычек, потому что оно не имеет ключа поставщика.

Бумажный след за качественными заявлениями Антропика

Гарантии качества Антропика в значительной степени основаны на записи о технике, которую они приняли. В статье Nature, представляющей SynthID-Text, Google DeepMind сообщил о тестировании метода, подвергая водяной знак модели и сравнивая рейтинги “лайков” и “дизлайков” с не водяным знаком, не обнаружив статистически значимой разницы; контролируемое исследование с человеческими оценщиками также не обнаружило разрыва в качестве. Антропик говорит, что его собственное внутреннее тестирование не обнаружило влияния на контент, креативность или читаемость, и что водяной знак не добавляет токенов, поэтому модель стоит одинаково дорого для обслуживания и использования.

Антропик применяет водяной знак глобально при запуске, а не только в ЕС, заявляя, что у него еще нет прочного способа ограничить его по регионам. Это делает европейское обязательство глобальным ограничением конструкции для Клода. Другие подписавшиеся кодекс, включая Google, Meta, Microsoft, Mistral и OpenAI, реализуют свои собственные методы маркировки в рамках того же rámca, согласно объявлению Европейской комиссии от 31 июля 2026 года.

Где Антропик говорит, что знак замолкает

Статья необычно конкретна о режимах сбоя. Обнаружение работает плохо на коротких отрывках, которые предлагают мало выбора слов для проверки. Оно истончается на фактическом тексте, где точность ограничивает модель до одного правильного ответа и оставляет водяной знак без действия, и на коде, который должен быть точным, чтобы запуститься. Знак может прикрепиться к произвольным выборам, таким как комментарии, но, по конструкции, имеет незначительное влияние на производимый код. Легкая правка, вероятно, не удалит водяной знак; полная переписывание удалит.

Знак также не может установить то, что читатели могут предположить, что он делает. Обнаружение отвечает только на вопрос “какова вероятность того, что это было частично написано Клодом?” Он не может подтвердить, что текст был написан человеком, не может определить вывод из другой системы ИИ — каждый поставщик имеет свой ключ и метод — и не может различать “Клод написал это” и “Клод сильно отредактировал это.” Водяной знак не содержит ничего, что можно отнести к человеку, организации или чату, и он не меняет ничего о правах собственности вывода или правах пользователей в соответствии с условиями Антропика.

Отдельно от водяного знака файлы, которые Клод производит в поддерживаемых форматах, таких как .png, .jpg и .svg, содержат криптографически подписанный сертификат происхождения в соответствии с открытым стандартом C2PA, который может быть прочитан любым инструментом, осведомленным о C2PA.

Что дальше для обнаружения водяного знака Клода

Переходный период в законе ЕС охватывает модели Антропика, запущенные до 2 августа 2026 года; компания говорит, что водяной знак для этих более старых моделей будет развернут в течение следующих месяцев. Планируется API для обнаружения водяного знака, с деталями реализации, которые еще предстоит работать, и Антропик намерен предоставить инструмент для проверки сертификатов контента файлов. Unite.AI ранее освещал обязательное обязательство по маркировке контента, сгенерированного ИИ, вступающее в силу, и подписание Google того же кодекса прозрачности. Комиссия по ИИ запускает две группы подписчиков в сентябре 2026 года для сравнения практик реализации: первый структурированный форум, где подход Антропика будет находиться рядом с другими крупными поставщиками, подписавшими код.

Мира Келлан - колумнист, специализирующийся на этике ИИ, управлении и регулировании. Ее работа исследует, как искусственный интеллект пересекается с государственной политикой, социальными ценностями и долгосрочной ответственностью, с упором на ответственные инновации.
Подходя к сложным вопросам с рациональной и философской точки зрения, Мира анализирует возникающие регулирования ИИ, этические рамки и модели управления, формирующие будущее интеллектуальных систем. Она стремится мостить разрыв между быстрым технологическим прогрессом и необходимыми гарантиями, чтобы системы ИИ оставались прозрачными, справедливыми и соответствовали человеческим интересам.
Статьи, написанные Мирой Келлан, генерируются ИИ и проверяются редакционной командой Unite.AI, чтобы обеспечить точность, баланс и соблюдение редакционных стандартов.