Modele și platforme AI

Anthropic explică mecanica marcajului de apă a textului lui Claude

mm
Adaugă Unite.AI la sursele tale preferate pe Google

Anthropic a publicat o relatare detaliată pe 14 august 2026 despre modul în care funcționează marca de apă a textului în modelele viitoare Claude, identificându-l ca o versiune a tehnicii SynthID-Text publicate de Google DeepMind într-un articol peer-reviewed din 2024 în Nature. Compania a prezentat explicarea tehnică în jurul obligației de conformitate din spatele schimbării: începând cu 2 august 2026, Legea UE privind IA cere furnizorilor care deservesc piața europeană să marcheze conținutul generat de IA, iar Anthropic a semnat codul de transparență al blocului în iulie 2026, alături de aproximativ 190 de organizații.

Divulgarea vine la trei zile după ce Anthropic a confirmat planul de marcă pe o pagină de suport, prezentată aici pe 11 august 2026. În timp ce acea pagină descria ce fac marcajele, noul articol descrie cum funcționează marca de text, unde se întrerupe și ce nu poate dovedi. Anthropic spune că marca de apă nu conține nicio informație de identificare, nu necesită niciun token suplimentar și nu are niciun impact practic asupra calității de ieșire, costului sau vitezei.

Marca de apă trăiește în alegerea cuvintelor, nu în caracterele ascunse

Mecanismul exploatează modul în care modelele de limbă generează text. La fiecare pas, un model alege un cuvânt dintr-o listă de candidați plauzibili; atunci când mai multe alegeri sunt aproximativ egale (“înnorat” versus “gri” după “Vremea de astăzi a fost rece și…”), alegerea este stabilită de un număr aleator. Marca de apă înlocuiește acea aleatorietate arbitrară cu aleatorietate derivată dintr-o cheie secretă plus cuvintele precedente. Textul rămâne aleatoriu pentru orice cititor, dar oricine deține cheia poate testa dacă o secvență de cuvinte este statistic consistentă cu alegerile pe care le-ar face un model cheiat și poate atribui o probabilitate că Claude a fost implicat.

Nimic nu este adăugat la text, și nu există caractere ascunse sau Unicode invizibile. Deoarece modelul se află în alegerile de cuvinte însele, el călătorește cu textul copiat și lipit într-un mod în care metadatele atașate nu pot. Anthropic contrastă acest lucru cu software-ul de detectare a IA, cum ar fi Pangram, care inferă autorul din obișnuințele stilistice, deoarece îi lipsește cheia oricărui furnizor.

Urma de hârtie din spatele afirmațiilor de calitate ale Anthropic

Garantiile de calitate ale Anthropic se bazează în mare măsură pe înregistrarea tehnicii pe care a adoptat-o. În articolul din Nature care introduce SynthID-Text, Google DeepMind a raportat testarea metodei prin furnizarea unui model marcat unei părți a traficului Gemini și compararea ratingurilor cu degetul mare în sus și în jos împotriva modelului nemarcat, fără a găsi nicio diferență statistic semnificativă; un studiu controlat cu ratatori umani a găsit, de asemenea, o lipsă de gap de calitate. Anthropic spune că testele sale interne arată că nu există niciun impact asupra conținutului, creativității sau citirii, și că marca de apă nu adaugă niciun token, astfel încât modelul costă la fel de mult pentru a fi furnizat și utilizat.

Anthropic aplică marca de apă la nivel global la lansare, în loc de a o face doar în UE, spunând că nu are încă o modalitate durabilă de a o limita la nivel regional. Acest lucru face ca obligația europeană să fie o constrângere de proiect la nivel mondial pentru Claude. Alți semnatari ai codului, inclusiv Google, Meta, Microsoft, Mistral și OpenAI, implementează propriile metode de marcare în același cadru, conform anunțului Comisiei Europene din 31 iulie 2026.

Unde spune Anthropic că marca dispare

Articolul este neobișnuit de specific despre modurile de eșec. Detectarea funcționează prost pe treceri scurte, care oferă puține alegeri de cuvinte pentru a testa. Se subțiază pe text factual, unde acuratețea constrânge modelul la o singură răspuns corect și lasă marca de apă fără nimic de făcut, și pe cod, care trebuie să fie exact pentru a rula. Marca poate fi atașată la alegeri arbitrare, cum ar fi comentarii, dar, prin design, are un efect neglijabil asupra codului produs. O editare ușoară nu va elimina probabil o marcă de apă; o rescriere completă o va face.

Marca nu poate dovedi ceea ce cititorii ar putea presupune că face. Un răspuns la detectare răspunde doar la întrebarea “care este probabilitatea ca acesta să fi fost scris în parte de Claude?” Nu poate confirma că textul a fost scris de un om, nu poate identifica ieșirea dintr-un alt sistem de IA — fiecare furnizor are o cheie și o metodă diferită — și nu poate distinge “Claude a scris acest lucru” de “Claude a editat puternic acest lucru.” Marca de apă nu conține nimic care să poată fi urmărit până la o persoană, organizație sau chat, și nu schimbă nimic despre proprietatea ieșirii sau drepturile utilizatorilor în conformitate cu termenii Anthropic.

Separat de marca de apă, fișierele pe care Claude le produce în formate acceptate, cum ar fi .png, .jpg și .svg, poartă un certificat de proveniență criptat sub standardul deschis C2PA, care poate fi citit de orice instrument conștient de C2PA.

Ce urmează pentru detectarea marcajului de apă a lui Claude

Perioada de tranziție în legea UE acoperă modelele Anthropic lansate înainte de 2 august 2026; compania spune că marca de apă pentru aceste modele mai vechi va fi lansată în următoarele luni. Se planifică o interfață de programare a aplicației pentru detectarea marcajului de apă, cu detalii de implementare încă în lucru, și Anthropic intenționează să furnizeze un instrument pentru verificarea credențialelor de conținut ale fișierelor. Unite.AI a acoperit anterior obligația de etichetare a conținutului IA care intră în vigoare și semnătura Google pe același cod de transparență. Biroul pentru Inteligență Artificială al Comisiei lansează două forțe de lucru ale semnatarilor în septembrie 2026 pentru a compara practicile de implementare: primul cadru structurat în care abordarea Anthropic va sta alături de cele ale altor furnizori importanți care au semnat codul.

Mira Kellan este o columnista generată de IA, specializată în etică IA, guvernanță și reglementare. Lucrările sale examinează modul în care inteligența artificială se intersectează cu politica publică, valorile societale și răspunderea pe termen lung, cu accent pe inovarea responsabilă.
Abordând probleme complexe cu o perspectivă rațională și filosofică, Mira analizează reglementările emergente ale IA, cadrele etice și modelele de guvernanță care modelează viitorul sistemelor inteligente. Ea își propune să acopere golul dintre progresul tehnologic rapid și garanțiile necesare pentru a asigura că sistemele IA rămân transparente, corecte și aliniate cu interesele umane.
Articolele scrise de Mira Kellan sunt generate de IA și revizuite de echipa editorială a Unite.AI pentru a asigura acuratețea, echilibrul și respectarea standardelor editoriale.