Modelli e piattaforme di IA
Anthropic Spiega i Meccanismi del Marchio di Acqua del Testo di Claude

Anthropic ha pubblicato un resoconto dettagliato il 14 agosto 2026 su come funziona il marchio di acqua del testo nei modelli futuri di Claude, identificandolo come una versione della tecnica SynthID-Text pubblicata da Google DeepMind in un articolo peer-reviewed del 2024 su Nature. La società ha inquadrato il documento tecnico intorno all’obbligo di conformità dietro il cambiamento: a partire dal 2 agosto 2026, il Regolamento UE sull’IA richiede ai fornitori che servono il mercato europeo di contrassegnare il contenuto generato dall’IA, e Anthropic ha firmato il codice di trasparenza dell’UE a luglio 2026 insieme a circa 190 organizzazioni.
La divulgazione arriva tre giorni dopo che Anthropic ha confermato il piano di marcatura su una pagina di supporto, trattata qui l’11 agosto 2026. Mentre quella pagina descriveva cosa fanno i marchi, il nuovo post descrive come funziona il marchio di testo, dove si rompe e cosa non può dimostrare. Anthropic afferma che il marchio di acqua non contiene informazioni di identificazione, non richiede token aggiuntivi e non ha alcun impatto pratico sulla qualità di output, costo o velocità.
Il Marchio di Acqua Vive nella Scelta delle Parole, Non nei Caratteri Nascosti
Il meccanismo sfrutta il modo in cui i modelli di linguaggio generano testo. A ogni passo, un modello seleziona una parola da un elenco di candidati plausibili; quando diverse scelte sono approssimativamente uguali (“coperto” versus “grigio” dopo “Il tempo oggi era freddo e…”), la scelta è stabilita da un numero casuale. Il marchio di acqua sostituisce quell’arbitrarietà con casualità derivata da una chiave segreta più le parole precedenti. Il testo rimane casuale per qualsiasi lettore, ma chiunque detenga la chiave può testare se una sequenza di parole è statisticamente coerente con le scelte che un modello con chiave avrebbe fatto, e assegnare una probabilità che Claude sia stato coinvolto.
Nessuno è aggiunto al testo, e non ci sono caratteri nascosti o Unicode invisibili. Poiché il modello si trova nelle scelte di parole stesse, viaggia con il testo copiato e incollato in un modo che i metadati allegati non possono. Anthropic contrasta questo con il software di rilevamento AI come Pangram, che inferisce l’autore dallo stile perché manca della chiave del fornitore.
La Documentazione dietro le Affermazioni di Qualità di Anthropic
Le garanzie di qualità di Anthropic si basano in gran parte sul record della tecnica che ha adottato. Nell’articolo di Nature che introduce SynthID-Text, Google DeepMind ha riportato test condotti servendo un modello con marchio di acqua a una fetta del traffico Gemini e confrontando i voti di pollice in su e pollice in giù contro il modello senza marchio di acqua, trovando nessuna differenza statisticamente significativa; uno studio controllato a lato a lato con valutatori umani ha trovato anch’esso nessuna lacuna di qualità. Anthropic afferma che i propri test interni mostrano nessun impatto sul contenuto, creatività o leggibilità, e che il marchio di acqua non aggiunge token, quindi il modello costa lo stesso da servire e utilizzare.
Anthropic sta applicando il marchio di acqua a livello globale al lancio invece di solo nell’UE, affermando di non avere ancora un modo duraturo per limitarlo per regione. Ciò rende l’obbligo europeo una limitazione di progettazione globale per Claude. Altri firmatari del codice, tra cui Google, Meta, Microsoft, Mistral e OpenAI, stanno implementando i propri metodi di marcatura secondo lo stesso quadro, secondo l’annuncio della Commissione europea del 31 luglio 2026.
Dove Anthropic Dice che il Marchio di Acqua Si Fa Silenzioso
Il post è insolitamente specifico sui modi di fallimento. La rilevazione funziona male su passaggi brevi, che offrono poche scelte di parole da testare. Si assottiglia su testo fattuale, dove l’accuratezza costringe il modello a una sola risposta giusta e lascia il marchio di acqua senza nulla da fare, e sul codice, che deve essere esatto per funzionare. Il marchio può attaccarsi a scelte arbitrarie come commenti ma, per progetto, ha un effetto trascurabile sul codice prodotto. Una leggera modifica probabilmente non rimuoverà un marchio di acqua; una completa riscrittura sì.
Il marchio non può stabilire ciò che i lettori potrebbero supporre che faccia. Un rilevamento risponde solo alla domanda “qual è la probabilità che questo sia stato scritto in parte da Claude?” Non può confermare che il testo sia stato scritto da un umano, non può identificare l’output di un altro sistema AI — ogni fornitore ha una chiave e un metodo diversi — e non può distinguere “Claude ha scritto questo” da “Claude ha modificato pesantemente questo.” Il marchio di acqua non contiene nulla riconducibile a una persona, organizzazione o chat, e non cambia nulla sulla proprietà di output o sui diritti degli utenti secondo i termini di Anthropic.
A parte il marchio di acqua, i file che Claude produce in formati supportati come .png, .jpg e .svg portano un credenziale di provenienza firmato criptograficamente secondo lo standard aperto C2PA, leggibile da qualsiasi strumento consapevole di C2PA.
Cosa Arriva Dopo per la Rilevazione del Marchio di Acqua di Claude
Il periodo di transizione nella legge UE copre i modelli di Anthropic lanciati prima del 2 agosto 2026; la società afferma che il marchio di acqua per quei modelli più vecchi sarà implementato nei prossimi mesi. Un’API di rilevamento del marchio di acqua è pianificata, con dettagli di implementazione ancora in fase di definizione, e Anthropic intende fornire uno strumento per controllare le credenziali di contenuto dei file. Unite.AI ha trattato in precedenza l’obbligo di etichettatura obbligatorio che entra in vigore e Google che firma lo stesso codice di trasparenza. L’Ufficio AI della Commissione lancerà due forze di lavoro dei firmatari in settembre 2026 per confrontare le pratiche di implementazione: il primo luogo strutturato in cui l’approccio di Anthropic siederà accanto a quelli degli altri principali fornitori che hanno firmato il codice.












