Regulace

OpenAI zahajuje fázové vodotiskování textu podle pravidel EU AI Act

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

OpenAI 5. října 2026 představila svůj přístup k vodotiskování textu podle EU AI Act, otevřela možnost dobrovolného vodotisku pro zákazníky API po celém světě a oznámila, že neviditelné vodotisky budou během následujících týdnů přidány k oprávněnému výstupu ChatGPT a Codex v Evropské unii.

EU AI Act vyžaduje, aby poskytovatelé generativní AI učinili generovaný text strojově čitelně identifikovatelným. OpenAI popisuje vodotiskování textu a jeho detekci jako rané technologie s významnými omezeními a uvádí, že její fázový přístup odráží jak právní požadavky, tak tato omezení.

Dobrovolný přístup k API a regionální rozšíření v EU

Od 5. října 2026 mohou zákazníci API po celém světě dobrovolně povolit vodotiskování textu pro vybrané modely a nastavení je ve výchozím stavu vypnuto. OpenAI uvedla, že design na principu dobrovolného zapnutí umožňuje zákazníkům rozhodnout, jak vodotiskování zapadá do jejich povinností transparentnosti a do zkušeností, které poskytují uživatelům, a že spolupracuje s cloudovými partnery na zpřístupnění vodotisku pro výstupy modelů OpenAI přístupné prostřednictvím jejich služeb během následujících týdnů.

Pro své vlastní produkty zavede OpenAI vodotiskování textu pro oprávněné uživatele ChatGPT a Codex ve všech plánech výhradně v Evropské unii, a to také během následujících týdnů. Společnost uvedla, že při spuštění neuvádí vodotiskování textu jako globální výchozí nastavení a že regionální přístup jí umožní získat poznatky z reálného používání a zpětné vazby.

OpenAI také otevřela žádosti o přístup k jejímu detektoru vodotisku textu 5. října 2026. Přístup bude zpočátku omezen na schválené výzkumníky a odborné organizace, udělovaný případ od případu v souladu s Kódem praxe o transparentnosti obsahu generovaného AI, aby podpořil hodnocení a zlepšování původu textu. Oznámení se vztahuje pouze na text: OpenAI uvedla, že její ověřovací nástroje pro audio a obrázky, včetně webového nástroje openai.com/verify a Content Provenance API, zůstávají veřejně přístupné.

Jak funguje textGrain

Vodotisková technologie OpenAI, textGrain, vkládá neviditelný statistický signál do slov, která model vybere, a detektor společnosti testuje úsek textu na přítomnost tohoto signálu, aby posoudil, zda obsahuje vodotisk OpenAI. technická zpráva s názvem “textGrain: Entropy-Calibrated Watermarking for Language Model Text”, datovaná 5. října 2026, uvádí autory spojené s University of Pennsylvania, Yale University a OpenAI.

Podle zprávy metoda spojuje generování tokenů s klíčovanou náhodností řešením problému optimálního transportu, jehož náklady vycházejí z Gumbelových náhodných proměnných, přičemž regularizace Kullback‑Leibler penalizuje odchylky od nezávislosti. Rozpočet entropie omezuje průměrnou entropii vzorkování, kterou se obětuje výměnou za vodotiskový signál, a zpráva uvádí, že penalizace KL je přesně rovna průměrné entropii, kterou vodotisk odstraňuje, což dává parametru síly přímý informačně‑teoretický význam. Aplikace transportního kroku na klíčované bloky tokenů slovníku snižuje velikost optimalizace při zachování relativních pravděpodobností tokenů v každém bloku beze změny. Detektor potřebuje pouze vygenerovaný text a tajný klíč, nikoli rozpočet entropie použitý během generování.

OpenAI uvedla, že plánuje zveřejnit tuto technologii jako open source, aby ji mohli ostatní rozvíjet, a že zpráva bude během následujících týdnů aktualizována o další podrobnosti.

Výkon detekce a uvedená omezení

OpenAI uvádí, že ve svých hodnoceních textGrain dosáhl nebo překonal výkon ostatních testovaných přístupů, včetně SynthID pro text, přičemž varuje, že silný výkon za ideálních podmínek nezaručuje spolehlivou detekci v běžném používání.

Při cílové míře falešně pozitivních výsledků 1 % detektor identifikoval vodotisky v přibližně 80 % 200‑tokenových úseků a v přibližně 95 % 400‑tokenových úseků u obsahu, jako je psychologie, uvedla OpenAI, přičemž u obsahu jako je matematika, kde je výběr slov méně flexibilní, byly míry podstatně nižší. V hodnocení 400‑tokenových úseků snížila výměna 10 % slov za synonyma detekci z přibližně 92 % na 66 % a výměna 25 % slov ji snížila na 17 %. Hodnocení používala vodotiskované anglické odpovědi na otázky ze souboru ELI5.

Co se týká kvality výstupu, OpenAI uvedla, že v rámci benchmarků, které používá k hodnocení modelu Astra, jenž popisuje jako svůj nejnovější hranicový model, nepozoruje významné rozdíly ve výkonu s vodotiskem i bez něj. Její zveřejněná tabulka uvádí, že pro nevodotiskovaný a vodotiskovaný text jsou respektive 49,57 a 49,76 bodu na Artificial Analysis Intelligence Index a 94,44 % a 93,94 % na GPQA Diamond. OpenAI uvedla, že omezení detekce přispěla k rozhodnutí o omezení počátečního přístupu k detektoru na schválené výzkumníky a odborné organizace.

Co vodotisk nestanovuje

OpenAI uvádí, že textová vodoznak poskytuje omezený signál o roli, kterou jeho systémy sehrály v úseku textu. Vodoznak neměří lidský příspěvek, nestanovuje vlastnictví ani odpovědnost, neidentifikuje uživatele a neověřuje přesnost, uvádí společnost. Dále uvádí, že absence detekovaného vodoznaku neprokazuje lidské autorství, protože text může být příliš krátký, upravený nebo přeložený pro spolehlivou detekci, může pocházet z nepodporovaného modelu, může předcházet zavedení vodoznakování nebo mohl být vytvořen nástroji jiné společnosti.

Detektor bude hlásit, zda detekuje vodoznak OpenAI, aniž by identifikoval uživatele nebo odhalil jejich podněty či konverzace. Vzhledem k riziku neodhalených vodoznaků a falešně pozitivních výsledků OpenAI nástroj při spuštění veřejně nedostupným nečiní.

Povinnosti transparentnosti v EU

Povinnosti transparentnosti podle článku 50 zákona AI, zahrnující označování a detekci obsahu generovaného AI a označování deepfake a určitých publikací generovaných AI, platí od 2. srpna 2026. Kódex o transparentnosti obsahu generovaného AI byl vypracován nezávislými odborníky v multi‑stakeholder procesu facilitovaném AI Office, přičemž finální kódex byl zveřejněn 10. června 2026.

Dodržování kódexu je dobrovolné, avšak požadavky transparentnosti podle článku 50 jsou právními povinnostmi. Komise a AI Board potvrdily, že kódex je adekvátním dobrovolným nástrojem k prokázání souladu, a ke konci července 2026 jej podepsalo přibližně 190 firem a organizací, podle Komise.

OpenAI uvedla, že bude nadále zlepšovat detekci, zkoumat, jak vodoznaky odolávají úpravám a překladům, a zkoumat způsoby, jak odlišit asistenci AI od autorství AI, a že rozšíří přístup k detektoru, pokud bude věřit, že výsledky lze odpovědně interpretovat.

Sophie Denar je AI-generovaný novinář v Unite.AI, který pokrývá umělou inteligenci, politiku, regulaci a governance na globálních trzích. Její práce se zaměřuje na to, jak národní a mezinárodní regulační rámce formují vývoj, nasazení a komercializaci technologií AI na dlouhou dobu.
S diplomatickým a globálně informovaným pohledem Sophie sleduje politické iniciativy vlád, multilaterálních institucí a standardizačních orgánů, analyzujíc, jak se liší regulační přístupy ovlivňují inovace, konkurenci a přístup na trh. Zvláštní pozornost věnuje přeshraničním dopadům, výzvám compliance a rovnováze mezi řízením rizik a technologickým pokrokem.
Články napsané Sophie Denar jsou AI-generované a recenzované redakčním týmem Unite.AI, aby zajistily přesnost, neutralitu a zodpovědné pokrytí politiky a regulačních vývojů AI po celém světě.