Регулювання
OpenAI починає поетапне водяне маркування тексту за правилами EU AI Act

OpenAI 5 жовтня 2026 року виклала свій підхід до водяного маркування тексту згідно з EU AI Act, відкривши можливість opt‑in маркування для клієнтів API по всьому світу та оголосивши, що невидимі водяні позначки будуть додані до відповідного виводу тексту ChatGPT і Codex у Європейському Союзі протягом наступних тижнів.
EU AI Act вимагає від постачальників генеративного ШІ робити згенерований текст ідентифікованим у машинозчитуваному вигляді. OpenAI описала водяне маркування тексту та його виявлення як ранні технології зі значними обмеженнями і зазначила, що її поетапний підхід відображає як юридичні вимоги, так і ці обмеження.
Opt‑In доступ до API та регіональне розгортання в ЄС
З 5 жовтня 2026 року клієнти API по всьому світу можуть opt‑in до водяного маркування для окремих моделей, а параметр за замовчуванням вимкнено. OpenAI заявила, що дизайн opt‑in дозволяє клієнтам вирішувати, як маркування відповідає їхнім зобов’язанням щодо прозорості та досвіду, який вони надають користувачам, і що компанія співпрацює з хмарними партнерами, щоб зробити маркування доступним для виводу моделей OpenAI, доступних через їхні сервіси, протягом наступних тижнів.
Для власних продуктів OpenAI впровадить водяне маркування тексту для відповідних користувачів ChatGPT і Codex у всіх планах лише в Європейському Союзі, також протягом наступних тижнів. Компанія заявила, що не робить водяне маркування тексту глобальним за замовчуванням під час запуску і що регіональний підхід дозволить їй навчатися на реальному використанні та відгуках.
OpenAI також відкрила заявки на доступ до свого детектора водяного маркування тексту 5 жовтня 2026 року. Спочатку доступ буде обмежений схваленими дослідниками та експертними організаціями, надаваний індивідуально відповідно до Code of Practice on transparency of AI-generated content ЄС, з метою підтримки оцінки та вдосконалення походження тексту. Оголошення стосується лише тексту: OpenAI заявила, що її інструменти верифікації аудіо та зображень, включаючи веб‑інструмент openai.com/verify та Content Provenance API, залишаються публічно доступними.
Як працює textGrain
Технологія водяного маркування OpenAI, textGrain, вбудовує невидимий статистичний сигнал у слова, які обирає модель, а детектор компанії перевіряє фрагмент на наявність цього сигналу, щоб визначити, чи містить він водяну позначку OpenAI. Технічний звіт під назвою “textGrain: Entropy-Calibrated Watermarking for Language Model Text,” датований 5 жовтня 2026 року, містить список авторів, пов’язаних з University of Pennsylvania, Yale University та OpenAI.
За даними звіту, метод пов’язує генерацію токенів з ключовою випадковістю, розв’язуючи задачу оптимального транспорту, витрати в якій походять від випадкових змінних Гумбеля, а регуляризація Кульбака‑Лейблера штрафує відхилення від незалежності. Бюджет ентропії обмежує середню ентропію вибірки, яку віддають в обмін на сигнал водяної позначки, і у звіті зазначено, що штраф KL точно дорівнює середній ентропії, яку видаляє водяна позначка, надаючи параметру сили пряме інформативно‑теоретичне значення. Застосування кроку транспорту до ключових блоків токенів словника зменшує розмір оптимізації, зберігаючи незмінними відносні ймовірності токенів у кожному блоці. Детектор потребує лише згенерованого тексту та секретного ключа, а не бюджету ентропії, використаного під час генерації.
OpenAI заявила, що планує випустити технологію як відкритий код, щоб інші могли її розвивати, і що звіт буде оновлений додатковими деталями протягом наступних тижнів.
Продуктивність виявлення та заявлені обмеження
OpenAI повідомляє, що в своїх оцінках textGrain відповідав або перевищував продуктивність інших випробуваних підходів, включаючи SynthID для тексту, попереджаючи, що висока ефективність за ідеальних умов не гарантує надійного виявлення у повсякденному використанні.
За цільовим рівнем хибнопозитивних результатів у 1 %, детектор виявив водяні позначки приблизно в 80 % 200‑токенових фрагментів і в 95 % 400‑токенових фрагментів для контенту, такого як психологія, повідомила OpenAI, при значно нижчих показниках для контенту, такого як математика, де вибір слів менш гнучкий. У оцінці 400‑токенових фрагментів заміна 10 % слів синонімами знизила виявлення з приблизно 92 % до 66 %, а заміна 25 % слів — до 17 %. Оцінки використовували водяні англійські відповіді на питання з набору даних ELI5.
Щодо якості виводу, OpenAI заявила, що за результатами бенчмарків, які вона використовує для оцінки Astra, яку вона описує як свою найновішу передову модель, вона не спостерігає значних відмінностей у продуктивності з водяним маркуванням і без нього. У її опублікованій таблиці зазначено, що для незамаркованого та замаркованого тексту відповідно 49,57 і 49,76 балів за Artificial Analysis Intelligence Index та 94,44 % і 93,94 % за GPQA Diamond. OpenAI зазначила, що обмеження виявлення сприяли рішенню обмежити початковий доступ до детектора лише для схвалених дослідників та експертних організацій.
Чого не встановлює водяне маркування
OpenAI стверджує, що текстовий водяний знак забезпечує обмежений сигнал щодо ролі, яку її системи відіграли у фрагменті. Водяний знак не вимірює внесок людини, не встановлює власність чи відповідальність, не ідентифікує користувача і не перевіряє точність, зазначає компанія. Також зазначається, що відсутність виявленого водяного знака не доводить людське авторство, оскільки текст може бути надто коротким, відредагованим або перекладеним для надійного виявлення, може походити від непідтримуваної моделі, може передувати впровадженню водяних знаків або може бути згенерований інструментами іншої компанії.
Детектор повідомлятиме, чи виявив він водяний знак OpenAI, не ідентифікуючи користувача та не розкриваючи їх підказки чи розмови. З огляду на ризик пропущених водяних знаків і хибнопозитивних результатів, OpenAI не надає інструмент у публічний доступ під час запуску.
Зобов’язання щодо прозорості в ЄС
Зобов’язання щодо прозорості за статтею 50 Закону про ШІ, що охоплюють маркування та виявлення контенту, створеного ШІ, а також маркування дипфейків і певних публікацій, створених ШІ, набувають чинності з 2 серпня 2026 року. Code of Practice on Transparency of AI-generated Content був розроблений незалежними експертами в багатосторонньому процесі за сприяння AI Office, а остаточний кодекс був опублікований 10 червня 2026 року.
Дотримання кодексу є добровільним, проте вимоги щодо прозорості за статтею 50 є юридичними зобов’язаннями. Комісія та AI Board підтвердили, що кодекс є адекватним добровільним інструментом для демонстрації відповідності, і, за даними Комісії, близько 190 компаній та організацій підписали кодекс до кінця липня 2026 року.
OpenAI заявила, що продовжуватиме вдосконалювати виявлення, вивчати, як водяні знаки витримують редагування та переклад, а також досліджувати способи розрізнення допомоги ШІ від авторства ШІ, і що вона розширить доступ до детектора, коли вважатиме, що результати можна відповідально інтерпретувати.












