AI-mallit ja alustat

Anthropic Selittää Claude’n Tekstivedon Tunnistamisen Mekaniikan

mm
Lisää Unite.AI suosikkilähteisiisi Google-palvelussa

Anthropic julkaisi 14. elokuuta 2026 yksityiskohtaisen selityksen siitä, miten tulevien Claude-mallien tekstivedot toimivat, tunnistamalla sen SynthID-Text-tekniikaksi, jonka Google DeepMind julkaisi peer-review -artikkelissa Naturessa vuonna 2024. Yritys esitti teknisen selityksen ympärillä olevan muutoksen taustalla olevan velvoitteen: 2. elokuuta 2026 alkaen EU:n tekoälylain mukaan palveluntarjoajien on merkittävä tekoälyllä luotu sisältö, ja Anthropic allekirjoitti EU:n avoimuuskoodin heinäkuussa 2026 noin 190 organisaation kanssa.

Tiedonjulkistus tapahtuu kolme päivää sen jälkeen, kun Anthropic vahvisti vedenmerkintäsuunnitelman tukisivulla, josta kerrottiin täällä 11. elokuuta 2026. Siinä, missä sivu kuvasi, mitä merkit tekevät, uusi artikkeli kuvaa, miten tekstimerkki toimii, missä se menee rikki ja mitä se ei voi osoittaa. Anthropic sanoo, että vedenmerkki ei sisällä tunnistetietoja, ei vaadi lisätokenia ja ei vaikuta käytännössä lähtötekstin laatuun, kustannuksiin tai nopeuteen.

Tunniste Elää Sanojen Valinnassa, Ei Piilotettuina Merkekinä

Mekanismi hyödyntää kielen mallien tekstien generoimista. Jokaisessa vaiheessa malli valitsee yhden sanan luetteloista mahdollisista ehdokkaista; kun useita valintoja on likimain yhtä hyviä (“pilvinen” vastaan “harmaa” “Sää tänään oli kylmä ja…”), valinta ratkaistaan satunnaisella numerolla. Vedenmerkintä korvaa tuon satunnaisen satunnaisuuden salaisen avaimen ja edeltävien sanojen satunnaisuudella. Teksti on edelleen satunnainen kaikille lukijoille, mutta kuka tahansa, jolla on avain, voi testata, onko sana- sekvenssi tilastollisesti yhdenmukainen valintojen kanssa, joita avainmalli tekee, ja määrittää todennäköisyyden, että Claude oli osallisena.

Mihinkään tekstiin ei lisätä mitään, eikä ole piilotettuja merkkejä tai näkymättömiä Unicoden merkkejä. Koska malli istuu itsessään sanojen valinnoissa, se kulkee kopioitujen ja liitettyjen tekstien kanssa tavalla, jota kiinnitetty metadata ei voi. Anthropic vertaa tätä AI-havaitsemisohjelmistoon, kuten Pangramiin, joka arvioi kirjoittajan tyylin perusteella, koska sillä ei ole mitään tarjoajan avainta.

Paperin Jälki Anthropicin Laatuväittämien Takana

Anthropicin laatutakuu perustuu pääosin tekniikan kirjaamiseen, jonka se omaksui. Nature-artikkelissa, jossa esiteltiin SynthID-Text, Google DeepMind raportoi testanneensa menetelmän tarjoamalla vedenmerkittyä mallia Gemini-liikenteen osalle ja vertaamalla peukkuja ylös- ja alaspäin -arvioita vedenmerkitön malliin, ja havaittiin, että ei ollut tilastollisesti merkittävää eroa; ohjattu rinnakkaiskoe ihmisillä arvioijilla havaittiin myös, että ei ollut laadun kuilua. Anthropic sanoo, että sen oma sisäinen testaus osoittaa, että vedenmerkintä ei vaikuta sisältöön, luovuuteen tai lukukelpoisuuteen, ja että vedenmerkintä ei lisää tokenia, joten malli maksaa saman palvelun ja käytön.

Anthropic soveltaa vedenmerkintää maailmanlaajuisesti käynnistyskertaa eikä ainoastaan EU:ssa, sanomalla, ettei sillä ole kestävää tapaa rajoittaa sitä alueittain. Tämä tekee Euroopan velvoitteen maailmanlaajuiseksi suunnittelurajoitteeksi Claudelle. Muiden koodin allekirjoittajien, mukaan lukien Google, Meta, Microsoft, Mistral ja OpenAI, toteuttavat omat merkkimenetelmänsä saman kehyksen puitteissa, EU:n komission heinäkuun 31. päivän 2026 ilmoituksen mukaan.

Missä Anthropic Sanoo, Että Merkintä Menee Hiljaiseksi

Artikkeli on epätavallisen yksityiskohtainen epäonnistumistiloista. Havainnointi toimii huonosti lyhyillä kappaleilla, joissa on vain vähän sana- valintoja, joita voidaan testata. Se ohentuu faktatekstissä, jossa tarkkuus rajoittaa mallia yhteen oikeaan vastaukseen, jolloin vedenmerkintä ei voi toimia, ja koodissa, joka on täsmällinen suorittamiseksi. Merkintä voidaan liittää mihin tahansa valintaan, kuten kommentteihin, mutta sen on tarkoitus olla vaikutus koodiin. Pieni muokkaus ei todennäköisesti poista vedenmerkintää; täydellinen uudelleenkirjoitus poistaa.

Merkintä ei myöskään voi vahvistaa sitä, mitä lukijat voivat olettaa sen tekevän. Havainto vastaa ainoastaan kysymykseen “Mikä on todennäköisyys, että tämä on osittain kirjoitettu Claudella?” Se ei voi vahvistaa, että teksti on kirjoitettu ihmisvoimin, ei voi tunnistaa toisen tekoälyjärjestelmän tuotosta – jokaisen tarjoajan avain ja menetelmä eroaa – eikä voi erottaa “Claude kirjoitti tämän” ja “Claude muokkasi tämän”. Vedenmerkintä ei sisällä mitään, joka voidaan jäljittää henkilölle, organisaatiolle tai keskusteluun, eikä se muuta mitään lähtötekstin omistajuudesta tai käyttäjien oikeuksista Anthropicin ehtojen mukaan.

Erillään vedenmerkinnästä Claude tuottaa tiedostoja, jotka ovat muun muassa .png, .jpg ja .svg, salattu todiste C2PA- standardin mukaisesti, joka on luettavissa C2PA-työkalulla.

Mitä Seuraa Claude’n Vedenmerkintä Havainnoinnissa

Siirtymäaika EU-lainsäädännössä koskee Anthropic-malleja, jotka on käynnistetty ennen 2. elokuuta 2026; yritys sanoo, että vedenmerkintä vanhemmille malleille tulee olemaan käytössä seuraavien kuukausien aikana. Vedenmerkintä havainto-API on suunnitteilla, ja Anthropic aikoo tarjota työkalun tiedostojen sisällön todisteiden tarkistamiseksi. Unite.AI on aiemmin kertonut pakollisesta merkintävelvoitteen voimaantulosta ja Googlesta, joka allekirjoitti saman avoimuuskoodin. Komission tekoälytoimisto käynnistää kaksi allekirjoittajien tehtävää syyskuussa 2026 vertaamaan toteutuskohtia: ensimmäinen järjestelmällinen foorumi, jossa Anthropicin lähestymistapa on rinnakkain muiden suurten tarjoajien lähestymistapojen kanssa, jotka allekirjoittivat koodin.

Mira Kellan on tekoälygeneroiva kolumnisti, joka on erikoistunut tekoälyetiikkaan, hallintoon ja sääntelyyn. Hänen työnsä tarkastelee, miten tekoäly leikkaa julkisen politiikan, yhteiskunnallisten arvojen ja pitkän aikavälin vastuun kanssa, keskittyen vastuulliseen innovaatioon.
Hänen lähestymistapansa monimutkaisiin ongelmiin on rationaalinen ja filosofinen, ja Mira analysoi uusia tekoälysääntelyjä, eettisiä kehyksiä ja hallintomalleja, jotka muokkaavat älykkäiden järjestelmien tulevaisuutta. Hän pyrkii silittämään välin rakenteellisen edistymisen ja tarvittavien suojausten välillä, jotta tekoälyjärjestelmät pysyvät läpinäkyvinä, reiluina ja ihmisten etujen mukaisina.
Mira Kellanin kirjoittamat artikkelit ovat tekoälygeneroituja ja Unite.AI:n toimituksellinen tiimi tarkistaa ne tarkkaavaisuuden, tasapuolisuuden ja toimituksellisten standardien mukaisuuden varmistamiseksi.