Регулирование
OpenAI начинает поэтапное внедрение текстовых водяных знаков в соответствии с правилами EU AI Act

OpenAI 5 октября 2026 года описала свой подход к текстовым водяным знакам в рамках EU AI Act, открыв возможность включения водяных знаков по запросу для клиентов API по всему миру и объявив, что невидимые водяные знаки будут добавлены к соответствующему текстовому выводу ChatGPT и Codex в Европейском союзе в ближайшие недели.
EU AI Act требует от поставщиков генеративного ИИ делать сгенерированный текст идентифицируемым машинным способом. OpenAI описала текстовые водяные знаки и их обнаружение как ранние технологии со значительными ограничениями и заявила, что её поэтапный подход отражает как правовые требования, так и эти ограничения.
Доступ к API по запросу и региональный запуск в ЕС
С 5 октября 2026 года клиенты API по всему миру могут включать текстовые водяные знаки для выбранных моделей, при этом настройка по умолчанию отключена. OpenAI заявила, что дизайн с включением по запросу позволяет клиентам решать, как водяные знаки соответствуют их обязательствам по прозрачности и опыту, который они предоставляют пользователям, а также что компания работает с облачными партнёрами, чтобы сделать водяные знаки доступными для выводов моделей OpenAI, получаемых через их сервисы, в ближайшие недели.
Для собственных продуктов OpenAI внедрит текстовые водяные знаки для подходящих пользователей ChatGPT и Codex во всех тарифных планах только в Европейском союзе, также в ближайшие недели. Компания заявила, что не делает текстовые водяные знаки глобальным значением по умолчанию при запуске, и что региональный подход позволит ей учиться на реальном использовании и отзывах.
OpenAI также открыло заявки на доступ к своему детектору текстовых водяных знаков 5 октября 2026 года. Доступ первоначально будет ограничен одобренными исследователями и экспертными организациями, предоставляемыми в каждом случае в соответствии с Code of Practice on transparency of AI-generated content ЕС, для поддержки оценки и улучшения происхождения текста. Объявление относится только к тексту: OpenAI заявила, что её инструменты проверки аудио и изображений, включая веб‑инструмент openai.com/verify и Content Provenance API, остаются общедоступными.
Как работает textGrain
Технология водяных знаков OpenAI, textGrain, внедряет невидимый статистический сигнал в слова, выбранные моделью, а детектор компании проверяет отрывок на наличие этого сигнала, чтобы определить, содержит ли он водяной знак OpenAI. Технический отчет под названием «textGrain: Entropy-Calibrated Watermarking for Language Model Text», датированный 5 октября 2026 года, перечисляет авторов, аффилированных с University of Pennsylvania, Yale University и OpenAI.
Согласно отчёту, метод связывает генерацию токенов с ключевой случайностью, решая задачу оптимального транспорта, где затраты выводятся из случайных переменных Гумбеля, а регуляризация Кульбака‑Лейблера штрафует отклонения от независимости. Бюджет энтропии ограничивает среднюю энтропию выборки, отдаваемую в обмен на сигнал водяного знака, и в отчёте указано, что штраф KL точно равен средней энтропии, которую удаляет водяной знак, придавая параметру силы прямое информационно‑теоретическое значение. Применение шага транспорта к ключевым блокам токенов словаря уменьшает размер оптимизации, сохраняя относительные вероятности токенов внутри каждого блока неизменными. Детектору требуется только сгенерированный текст и секретный ключ, а не бюджет энтропии, использованный при генерации.
OpenAI заявила, что планирует выпустить технологию с открытым исходным кодом, чтобы другие могли её развивать, и что отчёт будет обновлён дополнительными деталями в ближайшие недели.
Производительность обнаружения и заявленные ограничения
OpenAI сообщает, что в своих оценках textGrain сопоставим или превосходит эффективность других протестированных подходов, включая SynthID для текста, однако предупреждает, что высокая эффективность в идеальных условиях не гарантирует надёжного обнаружения в повседневном использовании.
При целевом уровне ложных срабатываний 1 % детектор выявил водяные знаки примерно в 80 % отрывков из 200 токенов и примерно в 95 % отрывков из 400 токенов для контента, такого как психология, сообщает OpenAI, при значительно более низких показателях для контента, такого как математика, где выбор слов менее гибок. В оценке отрывков из 400 токенов замена 10 % слов синонимами снизила обнаруживаемость с около 92 % до 66 %, а замена 25 % слов — до 17 %. Оценки использовали водяные английские ответы на вопросы из набора данных ELI5.
Что касается качества вывода, OpenAI заявила, что по всем бенчмарк‑тестам, которые она использует для оценки Astra, которую она описывает как свою новейшую передовую модель, она не наблюдает значимых различий в производительности с водяными знаками и без них. В опубликованной таблице указано, что для не помеченного и помеченного текста соответственно набраны 49,57 и 49,76 балла по Artificial Analysis Intelligence Index и 94,44 % и 93,94 % по GPQA Diamond. OpenAI заявила, что ограничения обнаружения способствовали её решению ограничить первоначальный доступ к детектору одобренным исследователям и экспертным организациям.
Что не устанавливает водяной знак
OpenAI заявляет, что текстовый водяной знак предоставляет ограниченный сигнал о роли, которую их системы сыграли в данном отрывке. Водяной знак не измеряет человеческий вклад, не устанавливает право собственности или ответственность, не идентифицирует пользователя и не проверяет точность, как сообщает компания. Также отмечается, что отсутствие обнаруженного водяного знака не доказывает человеческое авторство, поскольку текст может быть слишком коротким, отредактированным или переведённым для надёжного обнаружения, может исходить из неподдерживаемой модели, предшествовать внедрению водяных знаков или быть сгенерированным инструментами другой компании.
Детектор будет сообщать, обнаруживает ли он водяной знак OpenAI, не идентифицируя пользователя и не раскрывая их подсказки или беседы. Учитывая риск пропуска водяных знаков и ложных срабатываний, OpenAI не делает инструмент общедоступным при запуске.
Требования к прозрачности в ЕС
Требования к прозрачности в соответствии со Статьёй 50 Закона об ИИ, охватывающие маркировку и обнаружение контента, созданного ИИ, а также маркировку дипфейков и некоторых публикаций, созданных ИИ, вступают в силу с 2 августа 2026 года. Code of Practice on Transparency of AI-generated Content был разработан независимыми экспертами в многостороннем процессе, фасилитированном AI Office, а окончательный кодекс опубликован 10 июня 2026 года.
Соблюдение кодекса является добровольным, однако требования к прозрачности по Статье 50 являются юридическими обязательствами. Комиссия и Совет по ИИ подтвердили, что кодекс представляет собой адекватный добровольный инструмент для демонстрации соответствия, и к концу июля 2026 года около 190 компаний и организаций подписали кодекс, согласно данным Комиссии.
OpenAI заявила, что продолжит улучшать обнаружение, изучать, как водяные знаки выдерживают редактирование и перевод, а также исследовать способы различения помощи ИИ и авторства ИИ, и что расширит доступ к детектору, когда будет уверена, что результаты могут быть интерпретированы ответственно.












