Angolo di Anderson
Utilizzare la ‘Probabilità’ come Metrica di Rilevamento dei Deepfake

Se i video e l’audio generati dall’AI diventano abbastanza buoni, i rilevatori di deepfake basati su artefatti visivi o altri segnali tradizionali non funzioneranno più. Tuttavia, dato che le persone raramente si discostano da comportamenti prevedibili, forse la ‘probabilità’ potrebbe essere adottata più profondamente come segnale di whether un video o una notizia sia probabile che sia vera.
Opinione All’inizio degli anni ’90, il rispettato ex calciatore britannico e commentatore sportivo televisivo David Icke rivelò casualmente in un programma di chat che era ‘il figlio di Dio’ – una rivelazione bizzarra e inaspettata che si sarebbe evoluta nel corso dei decenni successivi in una persistente e elaborata teoria della cospirazione su un segreto e potente cabal globale di ‘persone lucertola’.
Con l’adozione di Internet ancora alcuni anni lontana e l’avvento dei social media ancora più lontano, la dissonanza tra la celebrità di Icke e la natura delle sue nuove intuizioni ebbe un impatto profondo sul pubblico britannico – non meno a causa della completa mancanza di contesto o di qualsiasi tipo di preparazione per questo massiccio cambiamento, da una personalità sportiva ben nota e ben stabilita.
Più di vent’anni dopo, una scia simile e molto più oscura di questo shock sociale si verificò quando il caro attivista di beneficenza e conduttore di programmi televisivi per bambini Jimmy Savile fu trovato postumo essere un serial e rapace life-long sex offender che aveva usato la sua immagine pubblica wholesome per facilitare i suoi crimini.
La successiva indagine di polizia Operation Yewtree avrebbe portato alla luce molti altri personaggi famosi britannici con lunghe storie di reati sessuali; in seguito, la prosecuzione di Harvey Weinstein avrebbe portato a una scoperta simile di personaggi famosi americani coinvolti in reati sessuali, evolvendosi nel movimento #metoo e diventando permanentemente parte della cultura americana in uscite come The Morning Show. Le notizie ‘shock’ sembravano stare sviluppando un nuovo e improvviso modello – uno che sarebbe stato adottato in seguito dagli attaccanti dei deepfake.
La Fine della Rilevazione Tradizionale dei Deepfake?
Anche se i social media e l’AI fossero stati presenti all’inizio degli anni ’90, nessun sistema predittivo al mondo avrebbe potuto prevedere le rivelazioni di Icke nel programma di chat, che (come ricordo bene) non erano state in alcun modo preannunciate negli anni precedenti all’evento.
Ma allora, se l’AI fosse stata presente, avrebbe potuto impiegare del tempo per convincere un pubblico più ampio che le dichiarazioni di Icke non erano il prodotto di Google Veo 3, o di un altro dei nuovi framework di deepfake audio/video iper-realistici.
È solo negli ultimi 6-12 mesi che i metodi di deepfake dell’AI sono diventati abbastanza efficaci da soddisfare anni di allarmismo dei media sulla interferenza elettorale dei deepfake, e abbastanza capaci di generare il tipo di macchia reputazionale rapida che è falsa, ma difficile da cancellare in una cultura sempre più credula.
Fino ad ora, l’output video dell’AI di solito non raggiunge il vero realismo, limitato da ostacoli tecnici e sempre più polarizzato da un divario in aumento tra modelli occidentali restrittivi e rilasci open source cinesi non censurati**.
Tuttavia, noto sempre più nella letteratura di ricerca una concessione imminente di questa guerra fredda, ad esempio nel nuovo articolo Performance Decay in Deepfake Detection†:
‘[Noi] supponiamo che i video deepfake continueranno a contenere caratteristiche apprendibili dalle macchine che li distinguono in modo affidabile dai video autentici. Mentre le capacità dell’AI generativa continuano a migliorare rapidamente, questa supposizione potrebbe ben rompersi.
‘In una tale situazione, il watermarking e altri metodi di tracciamento della provenienza offriranno l’unica possibilità di mantenere la fiducia nei media digitali.’
Tuttavia, lo stesso articolo ammette che le soluzioni basate sulla provenienza, come l’iniziativa di autenticità del contenuto guidata da Adobe, e le molte offerte più piccole di ricerca degli ultimi 7-8 anni) richiedono un’adozione così ampia da essere irrealistica; e l’articolo termina con una nota generale di ritirata, se non di sconfitta.
Se i metodi di rilevamento dei deepfake audio-visivi sono superati dall’AI generativa, e l’adozione globale di uno schema di watermarking o di provenienza intrusivo cade a causa di diversi ostacoli logistici, quale caratteristica centrale comune potrebbe sostituirli come indicatori di output potenzialmente contraffatti? O dobbiamo rassegnarci a un mondo in cui tutti i media sono in dubbio, e il Liar’s Dividend prevale?
Grafi della Conoscenza
Sembra che sia giunto il momento di sfruttare più profondamente la probabilità e la plausibilità degli ‘eventi segnalati’ come caratteristica di segnale nel rilevamento dei deepfake. Inoltre, poiché i sistemi di AI generativa video e audio stanno convergendo sempre più, potrebbe essere anche il momento per le ricerche separate sui ‘fake news’ (come evento narrativo basato sul testo) e sui fake immagini/video di convergere in modo simile.
Una probabilità metrica deepfake non è la stessa cosa del RAG-aided verifica dei fatti, dove un modello di AI può portare i risultati web correnti per acquisire conoscenza degli eventi che si verificano dopo la sua data di chiusura, e/o per corroborare le sue affermazioni.
Al contrario, eseguirebbe previsioni basate su tendenze statistiche generalmente indicative, derivate da modelli storici che si conformano a una richiesta corrente.
In questo senso, un metodo di probabilità è più vicino all’analisi statistica che ai filoni più moderni della scena dell’apprendimento automatico attuale.
Sebbene in precedenza eclissato da approcci più moderni dell’era dei Transformer, i grafi della conoscenza stanno facendo qualcosa di un ritorno nello spazio aziendale, e sembrano adattati al potenziale schieramento di metriche di ‘probabilità’ nel rilevamento dei deepfake.

Un grafo della conoscenza semplificato che illustra come le persone, i luoghi, le opere d’arte e gli eventi possano essere collegati attraverso relazioni etichettate, abilitando le macchine a ragionare su entità del mondo reale e le loro connessioni. Fonte
Un grafo della conoscenza è un modo di organizzare le informazioni mappando cose del mondo reale come persone, aziende, eventi o idee in una rete di fatti collegati.
Ogni sub-entità è un nodo, e i collegamenti tra loro (edge) descrivono come sono collegati. Ad esempio, ‘Microsoft’ (MSFT ) (un nodo) potrebbe essere collegato a ‘OpenAI’ (un altro nodo) da un edge che dice ‘è un cliente di’. Questi collegamenti sono spesso archiviati in database grafici e seguono una struttura di soggetto-predicato-oggetto, come ‘Microsoft è un cliente di OpenAI’.
Memoria Persistente
Uno studio cinese di settembre di quest’anno ha proposto un metodo di formazione gratuito che utilizza il ragionamento basato su grafi per rilevare incoerenze sottili nei deepfake multimodali.
Invece di generare razionali o fine-tuning grandi modelli, il sistema recupera coppie di immagini e testi, costruisce un grafo di similarità e punteggia i collegamenti, al fine di recuperare gli esempi più pertinenti, e questi guidano il giudizio del modello senza la necessità di una nuova formazione:

Un panorama del framework GASP-ICL, che migliora il rilevamento dei deepfake combinando la selezione di campioni basata su grafi con l’apprendimento in contesto, consentendo a un modello di visione-linguaggio congelato di classificare le coppie di immagini/testo come reali o false, senza formazione o fine-tuning. Fonte
Questo è probabilmente il lavoro più vicino, certamente quello che ho trovato, a un approccio ‘informato’ e consapevole della storia per la valutazione e la verifica della nuova produzione multimediale. Per la maggior parte, gli approcci di visione computerizzata continuano ad analizzare immagini (inclusi frame di video e anomalie temporali che abbracciano più frame) mentre i framework di rilevamento di ‘fake news’ continuano a enfatizzare i dati basati sul testo, anche in progetti multimodali.
Creep delle Caratteristiche
La sfida di un sistema predittivo di questo tipo è l’ambito della sorveglianza che potrebbe essere necessario per rendere l’approccio completamente performante – almeno al di là dell’analisi dei personaggi famosi e delle figure pubbliche, per le quali esiste già dati liberamente accessibili.
Probabilmente il filone di ricerca più simile attuale è il campo della pre-crime, che etichetta diversi segnali di intelligenza multimodale come ‘sospetti’, e si presenta come un fantasma di AI coraggioso in uscite come Person of Interest (2011-2016) e Minority Report (2002).
Sebbene un sistema di sorveglianza onnivoro come Person of Interest produrrebbe risultati ottimali, è improbabile che la cultura occidentale possa sanzionare il livello di intrusività personale che le reti interne cinesi impongono ai propri cittadini.
Pertanto, per quanto riguarda le notizie false sui non-personaggi famosi, solo le agenzie governative come la polizia (nonché i registri di nascita e morte e gli uffici delle imposte) avrebbero abbastanza informazioni storiche pertinenti per informare le probabilità in un flusso di lavoro basato su grafi; e anche loro avrebbero bisogno di volontà, capacità, legislazione e risorse nello stile del CCCP per includere i cittadini comuni nella loro copertura e nelle loro analisi (cioè, al di là dei punti di dati banali ma obbligatori come i numeri di passaporto e le registrazioni di auto).
Punteggio di Probabilità
Sembra probabile che l’efficacia potenziale di un sistema di questo tipo sarebbe limitata ai casi di utilizzo più ovvi (attuali) per i contenuti deepfake: destabilizzazione (deepfake supportati dallo stato); deepfake di celebrità e ‘sconosciuti’ pornografici (che possono essere considerati entrambi maliziosi, sebbene il secondo caso tenda ad attirare una maggiore preoccupazione dei media); truffa (inclusi audio/video deepfake progettati per eseguire ‘furti di identità’); e assassinio del carattere politico.
Un sistema basato sulla conoscenza avrebbe bisogno di una scala di probabilità per una varietà di eventi possibili. A un’estremità dello spettro, fallimenti umani comuni come la gestione finanziaria discutibile, l’infedeltà, la dipendenza, la scorrettezza, ecc.; all’altra estremità… rivelare di essere il figlio di Dio in un programma di chat show live (o eventi di scala e impatto simili).
Anche in quest’ultimo caso, i fattori storici personali per un individuo peserebbero l’esito della probabilità: un personaggio politico di spicco che ha pubblicamente equivocato in questioni controverse (come la veridicità degli allunaggi lunari degli anni ’60 e ’70) per guadagnare capitale con un elettorato sempre più ‘informato in modo alternativo’ potrebbe guadagnare uno status di wildcard aggiuntivo nelle routine di verifica, rispetto ai suoi colleghi più sobri.
Nel caso dei deepfake di celebrità, c’è un contesto del mondo reale sufficiente (ad esempio, le fughe di foto di celebrità del 2012, tra gli altri – rari incidenti) per generare un moderato Liar’s Dividend, in certi contesti; ma poiché questi incidenti outlier tendono a funzionare come eccezioni che confermano la regola, la maggior parte dei deepfake di celebrità attuali basati sulla diffusione sarebbe considerata estremamente ‘improbabile’ (anche se ciò non risolve il problema dell’appropriazione delle identità delle persone per tali scopi).
In termini di disastro nazionale, c’è una notevole quantità di dati statistici che possono aiutare a valutare le probabilità di ‘rapporti disastrosi’. Anche nella storia antica, eventi apparentemente ‘improvvisi’ come l’eruzione del vulcano Vesuvio non identificato nel 79 d.C. erano stati preannunciati, se solo si fosse prestata sufficiente attenzione; e oltre la disponibilità di una moltitudine di feed supportati dal governo e da organizzazioni non governative, la capacità dell’AI di estrarre strutture da dati grezzi può fornire ulteriore contesto storico per la valutazione della probabilità.
Conclusione
Anche un sistema predittivo ben implementato di questo tipo non potrebbe tener conto del caso, degli atti di Dio, degli eventi improvvisi o degli eventi maliziosi congegnati al di fuori di qualsiasi supervisione.
Inoltre, il volume e la profondità dei dati necessari per fornire copertura anche per le persone non famose sarebbero un punto di svolta politica – almeno per il momento.
Tuttavia, le scelte sembrano restringersi; l’analisi basata sulla visione è sul punto di fallire di fronte all’AI generativa migliorata, mentre i sistemi di verifica e di provenienza portano un onere di debito tecnico e di attrito contro l’adozione. Ciò rende soluzioni come l’iniziativa di autenticità del contenuto e il sistema di copyright dei volti di Metaphysic.ai Metaphysic Pro difficili da popolarizzare.
Nel loro uso più ampio, i sistemi basati su RAG possono solo determinare se una fonte di autorità supporta un’affermazione non verificata; e poiché molte grandi storie vere emergono senza contesto precedente, la mancanza di sostegno da parte di fonti di autorità non è necessariamente significativa.
Il loro valore potrebbe dimostrarsi maggiore se potessero far parte di un ecosistema di dati più ampio che si occupa della cosa che la maggior parte delle forme attuali di AI trova difficile – il contesto storico.
* Non da confondere con le prime uscite dell’autoencoder che debuttarono nel 2017 e sarebbero stati in seguito sostituiti da approcci superiori.
† https://arxiv.org/abs/2511.07009
** Which can usually run freely on more powerful home PCs, instead of only being available via gate-kept APIs such as ChatGPT and the Veo series.
††† Omitting legitimate entertainment uses, such as professional visual effects in movie and TV productions.
Pubblicato per la prima volta giovedì 13 novembre 2025












