Sääntely

OpenAI aloittaa vaiheittaisen tekstivedenmerkin käyttöönoton EU AI Act -sääntöjen mukaisesti

mm
Lisää Unite.AI suosikkilähteisiisi Google-palvelussa

OpenAI on 5. lokakuuta 2026, esitteli lähestymistapansa tekstivedenmerkkaukseen EU AI Act-asetuksen alaisena, avaten valinnaisen vesileiman API-asiakkaille maailmanlaajuisesti ja ilmoittaen, että näkymättömät vesileimat lisätään kelvolliseen ChatGPT- ja Codex-tekstituotantoon Euroopan unionissa tulevina viikkoina.

EU AI Act edellyttää generatiivisten tekoälypalvelujen tarjoajia tekemään tuotetun tekstin koneellisesti luettavaksi. OpenAI kuvasi tekstivedenmerkin ja sen tunnistuksen varhaisiksi teknologioiksi, joilla on merkittäviä rajoituksia, ja totesi, että sen vaiheittainen lähestymistapa heijastaa sekä lainsäädännöllisiä vaatimuksia että näitä rajoituksia.

Valinnainen API-pääsy ja alueellinen EU-julkaisu

5. lokakuuta 2026 alkaen API-asiakkaat maailmanlaajuisesti voivat valita tekstivedenmerkin käyttöönoton valituissa malleissa, ja asetus on oletuksena pois päältä. OpenAI kertoi, että valinnainen malli antaa asiakkaille mahdollisuuden päättää, miten vedenmerkintä sopii heidän läpinäkyvyysvelvoitteisiinsa ja käyttäjäkokemuksiinsa, ja että se tekee yhteistyötä pilvipalvelukumppaneiden kanssa tehdäkseen vedenmerkinnän saatavilla OpenAI-mallien tulosteille, joihin pääsee heidän palveluidensa kautta tulevina viikkoina.

Omille tuotteilleen OpenAI ottaa käyttöön tekstivedenmerkin kelvollisille ChatGPT- ja Codex-käyttäjille kaikissa suunnitelmissa ainoastaan Euroopan unionissa, myös tulevina viikkoina. Yritys kertoi, ettei se tee tekstivedenmerkinnästä globaalista oletusasetuksesta lanseerauksessa, ja että alueellinen lähestymistapa mahdollistaa oppimisen todellisesta käytöstä ja palautteesta.

OpenAI avasi myös hakemuksia pääsyyn sen tekstivedenmerkin tunnistimeen 5. lokakuuta 2026. Pääsy on aluksi rajoitettu hyväksytyille tutkijoille ja asiantuntijaorganisaatioille, myönnetty tapauskohtaisesti EU:n Code of Practice on transparency of AI-generated content mukaisesti, tukemaan tekstin alkuperän arviointia ja parantamista. Ilmoitus koskee vain tekstiä: OpenAI kertoi, että sen äänen- ja kuvien varmistustyökalut, mukaan lukien openai.com/verify‑verkkotyökalu ja Content Provenance API, pysyvät julkisesti saatavilla.

Kuinka textGrain toimii

OpenAI:n vedenmerkintätekniikka, textGrain, upottaa näkymättömän tilastollisen signaalin mallin valitsemiin sanoihin, ja yrityksen tunnistin testaa kappaleen tätä signaalia vastaan arvioidakseen, sisältääkö se OpenAI:n vedenmerkin. tekninen raportti nimeltä “textGrain: Entropy-Calibrated Watermarking for Language Model Text,” päivätty 5. lokakuuta 2026, luettelee tekijöitä, jotka ovat yhteydessä University of Pennsylvaniayn, Yale Universityyn ja OpenAI:hin.

Raportin mukaan menetelmä sitoo tokenien generoinnin avainperusteiseen satunnaisuuteen ratkaisemalla optimaalisen kuljetusongelman, jonka kustannukset perustuvat Gumbel‑satunnaismuuttujiin, ja Kullback–Leibler‑säännöllistys rangaisee riippumattomuuden poikkeamia. Entropiabudjetti rajoittaa keskimääräistä näytteenottientropiaa, joka luovutetaan vedenmerkkinä signaalin vastineeksi, ja raportti toteaa, että KL‑rangaistus on täsmälleen yhtä suuri kuin vedenmerkki poistaa keskimääräistä entropiaa, antaen vahvuusparametrille suoran informaatioteoreettisen merkityksen. Kuljetusvaiheen soveltaminen avainlohkoihin sanaston tokenien joukossa pienentää optimoinnin kokoa säilyttäen kunkin lohkon suhteelliset token‑todennäköisyydet muuttumattomina. Tunnistin tarvitsee vain tuotetun tekstin ja salaisen avaimen, eikä entropiabudjettia, jota käytettiin generoinnin aikana.

OpenAI kertoi aikovansa julkaista teknologian avoimen lähdekoodin mukaisesti, jotta muut voivat kehittää sitä, ja että raporttia päivitetään lisätiedoilla tulevina viikkoina.

Tunnistuksen suorituskyky ja ilmoitetut rajoitukset

OpenAI raportoi, että sen arvioinneissa textGrain vastasi tai ylitti muiden testaamiensa lähestymistapojen, mukaan lukien SynthID tekstiin, suorituskyvyn, samalla varoittaen, että vahva suorituskyky ihanteellisissa olosuhteissa ei takaa luotettavaa tunnistusta jokapäiväisessä käytössä.

Tavoitevirhepositiivisuhteessa 1 % tunnistin havaitsi vedenmerkit noin 80 %:ssa 200‑tokenin kappaleista ja noin 95 %:ssa 400‑tokenin kappaleista sisällöissä kuten psykologia, OpenAI raportoi, ja huomioi huomattavasti alhaisemmat luvut sisällöissä kuten matematiikka, jossa sanavalinta on vähemmän joustavaa. 400‑tokenin kappaleiden arvioinnissa 10 %:n sanojen korvaaminen synonyymeillä vähensi tunnistusta noin 92 %:sta 66 %:iin, ja 25 %:n korvaaminen vähensi sen 17 %:iin. Arvioinnit käyttivät vedenmerkittyjä englanninkielisiä vastauksia ELI5‑aineistosta.

Laadun osalta OpenAI totesi, että kaikissa Astraa – jonka se kuvaa viimeisimpänä raja‑mallinaan – arviointiin käyttämissään vertailuarvioissa ei havaita merkittäviä suorituskykyeroja vedenmerkinnän kanssa tai ilman sitä. Julkaistussa taulukossa ilmoitetaan, että merkitsemättömälle ja merkittylle tekstille saatiin vastaavasti 49,57 ja 49,76 pistettä Artificial Analysis Intelligence Index -indeksissä sekä 94,44 % ja 93,94 % GPQA Diamond -testissä. OpenAI kertoi, että tunnistuksen rajoitukset vaikuttivat päätökseen rajoittaa alkuperäistä tunnistimen pääsyä hyväksytyille tutkijoille ja asiantuntijaorganisaatioille.

Mitä vedenmerkki ei vahvista

OpenAI toteaa, että tekstivedenmerkki tarjoaa rajoitetun signaalin siitä, millainen rooli sen järjestelmillä on ollut kappaleessa. Vedenmerkki ei mittaa ihmisen panosta, ei määritä omistajuutta tai vastuuta, ei tunnista käyttäjää eikä vahvista tarkkuutta, yritys kertoo. Lisäksi se toteaa, että havaitun vedenmerkin puuttuminen ei todista ihmisen tekijänoikeutta, koska teksti saattaa olla liian lyhyt, muokattu tai käännetty luotettavaa havaitsemista varten, saattaa tulla tukemattomasta mallista, saattaa olla ennen vedenmerkin käyttöönottoa, tai se on voitu tuottaa toisen yrityksen työkaluilla.

Tunnistin ilmoittaa, havaitseeko se OpenAI:n vedenmerkin ilman, että se tunnistaa käyttäjää tai paljastaa hänen kehotteitaan tai keskustelujaan. Ottaen huomioon riskin havaitsematta jääneistä vedenmerkeistä ja vääristä positiivisista tuloksista, OpenAI ei tee työkalua julkisesti saataville lanseerauksessa.

EU:n läpinäkyvyysvelvoitteet

Läpinäkyvyysvelvoitteet tekoälyasetuksen 50 artiklan mukaan, jotka koskevat tekoälyn tuottaman sisällön merkitsemistä ja havaitsemista sekä deepfakejen ja tiettyjen tekoälyn tuottamien julkaisujen merkintää, astuvat voimaan 2. elokuuta 2026. Code of Practice on Transparency of AI-generated Content laadittiin riippumattomien asiantuntijoiden toimesta moniosapuolisen prosessin kautta, jota AI-toimisto helpotti, ja lopullinen koodi julkaistiin 10. kesäkuuta 2026.

Koodin noudattaminen on vapaaehtoista, mutta 50 artiklan läpinäkyvyysvaatimukset ovat oikeudellisia velvoitteita. Komissio ja tekoälylautakunta ovat vahvistaneet, että koodi on riittävä vapaaehtoinen työkalu vaatimusten täyttämisen osoittamiseen, ja komission mukaan noin 190 yritystä ja organisaatiota oli allekirjoittanut koodin heinäkuun 2026 lopussa.

OpenAI ilmoitti jatkavansa havaitsemisen parantamista, tutkien, miten vedenmerkit kestävät muokkausta ja käännöstä, sekä tutkimalla keinoja erottaa tekoälyavustus tekoälykirjoittamisesta, ja että se laajentaa tunnistimen käyttöä, kun se katsoo, että tuloksia voidaan tulkita vastuullisesti.

Sophie Denar on tekoälygeneroiva journalisti Unite.AI:ssa, joka kattaa tekoälypolitiikkaa, sääntelyä ja hallintoa globaaleilla markkinoilla. Hänen työnsä keskittyy siihen, miten kansalliset ja kansainväliset sääntelykehykset muokkaavat tekoälytekniikoiden kehittymistä, käyttöönottoa ja kaupallistamista pitkällä aikavälillä.
Diplomaattisesta ja maailmanlaajuisesti informoidusta näkökulmasta Sophie seuraa hallitusten, monenkeskisten instituutioiden ja standardointielinten aloitteita, analysoi, miten erilaiset sääntelylähestymistavat vaikuttavat innovaatioon, kilpailuun ja markkinoiden saatavuuteen. Hän kiinnittää erityistä huomiota rajojen ylittäviin vaikutuksiin, noudattamisen haasteisiin ja riskienhallinnan ja teknologisen edistymisen tasapainoon.
Artikkelit, joita Sophie Denar on kirjoittanut, ovat tekoälygeneroivia ja Unite.AI:n toimituksen tarkastamia, jotta voidaan varmistaa tarkkuus, puolueettomuus ja vastuullinen kattavuus tekoälypolitiikasta ja sääntelystä kehityksistä maailmanlaajuisesti.