Angolo di Anderson
Utilizzare la ‘Probabilità ’ come Metrica di Rilevamento dei Deepfake

Se i video e lâaudio generati dallâAI diventano abbastanza buoni, i rilevatori di deepfake basati su artefatti visivi o altri segnali tradizionali non funzioneranno piÃđ. Tuttavia, dato che le persone raramente si discostano da comportamenti prevedibili, forse la âprobabilità â potrebbe essere adottata piÃđ profondamente come segnale di whether un video o una notizia sia probabile che sia vera.
Â
Opinione Allâinizio degli anni â90, il rispettato ex calciatore britannico e commentatore sportivo televisivo David Icke rivelÃē casualmente in un programma di chat che era âil figlio di Dioâ â una rivelazione bizzarra e inaspettata che si sarebbe evoluta nel corso dei decenni successivi in una persistente e elaborata teoria della cospirazione su un segreto e potente cabal globale di âpersone lucertolaâ.
Con lâadozione di Internet ancora alcuni anni lontana e lâavvento dei social media ancora piÃđ lontano, la dissonanza tra la celebrità di Icke e la natura delle sue nuove intuizioni ebbe un impatto profondo sul pubblico britannico â non meno a causa della completa mancanza di contesto o di qualsiasi tipo di preparazione per questo massiccio cambiamento, da una personalità sportiva ben nota e ben stabilita.
PiÃđ di ventâanni dopo, una scia simile e molto piÃđ oscura di questo shock sociale si verificÃē quando il caro attivista di beneficenza e conduttore di programmi televisivi per bambini Jimmy Savile fu trovato postumo essere un serial e rapace life-long sex offender che aveva usato la sua immagine pubblica wholesome per facilitare i suoi crimini.
La successiva indagine di polizia Operation Yewtree avrebbe portato alla luce molti altri personaggi famosi britannici con lunghe storie di reati sessuali; in seguito, la prosecuzione di Harvey Weinstein avrebbe portato a una scoperta simile di personaggi famosi americani coinvolti in reati sessuali, evolvendosi nel movimento #metoo e diventando permanentemente parte della cultura americana in uscite come The Morning Show. Le notizie âshockâ sembravano stare sviluppando un nuovo e improvviso modello â uno che sarebbe stato adottato in seguito dagli attaccanti dei deepfake.
La Fine della Rilevazione Tradizionale dei Deepfake?
Anche se i social media e lâAI fossero stati presenti allâinizio degli anni â90, nessun sistema predittivo al mondo avrebbe potuto prevedere le rivelazioni di Icke nel programma di chat, che (come ricordo bene) non erano state in alcun modo preannunciate negli anni precedenti allâevento.
Ma allora, se lâAI fosse stata presente, avrebbe potuto impiegare del tempo per convincere un pubblico piÃđ ampio che le dichiarazioni di Icke non erano il prodotto di Google Veo 3, o di un altro dei nuovi framework di deepfake audio/video iper-realistici.
à solo negli ultimi 6-12 mesi che i metodi di deepfake dellâAI sono diventati abbastanza efficaci da soddisfare anni di allarmismo dei media sulla interferenza elettorale dei deepfake, e abbastanza capaci di generare il tipo di macchia reputazionale rapida che ÃĻ falsa, ma difficile da cancellare in una cultura sempre piÃđ credula.
Fino ad ora, lâoutput video dellâAI di solito non raggiunge il vero realismo, limitato da ostacoli tecnici e sempre piÃđ polarizzato da un divario in aumento tra modelli occidentali restrittivi e rilasci open source cinesi non censurati**.
Tuttavia, noto sempre piÃđ nella letteratura di ricerca una concessione imminente di questa guerra fredda, ad esempio nel nuovo articolo Performance Decay in Deepfake Detectionâ :
â[Noi] supponiamo che i video deepfake continueranno a contenere caratteristiche apprendibili dalle macchine che li distinguono in modo affidabile dai video autentici. Mentre le capacità dellâAI generativa continuano a migliorare rapidamente, questa supposizione potrebbe ben rompersi.
âIn una tale situazione, il watermarking e altri metodi di tracciamento della provenienza offriranno lâunica possibilità di mantenere la fiducia nei media digitali.â
Tuttavia, lo stesso articolo ammette che le soluzioni basate sulla provenienza, come lâiniziativa di autenticità del contenuto guidata da Adobe, e le molte offerte piÃđ piccole di ricerca degli ultimi 7-8 anni) richiedono unâadozione cosÃŽ ampia da essere irrealistica; e lâarticolo termina con una nota generale di ritirata, se non di sconfitta.
Se i metodi di rilevamento dei deepfake audio-visivi sono superati dallâAI generativa, e lâadozione globale di uno schema di watermarking o di provenienza intrusivo cade a causa di diversi ostacoli logistici, quale caratteristica centrale comune potrebbe sostituirli come indicatori di output potenzialmente contraffatti? O dobbiamo rassegnarci a un mondo in cui tutti i media sono in dubbio, e il Liarâs Dividend prevale?
Grafi della Conoscenza
Sembra che sia giunto il momento di sfruttare piÃđ profondamente la probabilità e la plausibilità degli âeventi segnalatiâ come caratteristica di segnale nel rilevamento dei deepfake. Inoltre, poichÃĐ i sistemi di AI generativa video e audio stanno convergendo sempre piÃđ, potrebbe essere anche il momento per le ricerche separate sui âfake newsâ (come evento narrativo basato sul testo) e sui fake immagini/video di convergere in modo simile.
Una probabilità metrica deepfake non ÃĻ la stessa cosa del RAG-aided verifica dei fatti, dove un modello di AI puÃē portare i risultati web correnti per acquisire conoscenza degli eventi che si verificano dopo la sua data di chiusura, e/o per corroborare le sue affermazioni.
Al contrario, eseguirebbe previsioni basate su tendenze statistiche generalmente indicative, derivate da modelli storici che si conformano a una richiesta corrente.
In questo senso, un metodo di probabilità ÃĻ piÃđ vicino allâanalisi statistica che ai filoni piÃđ moderni della scena dellâapprendimento automatico attuale.
Sebbene in precedenza eclissato da approcci piÃđ moderni dellâera dei Transformer, i grafi della conoscenza stanno facendo qualcosa di un ritorno nello spazio aziendale, e sembrano adattati al potenziale schieramento di metriche di âprobabilità â nel rilevamento dei deepfake.

Un grafo della conoscenza semplificato che illustra come le persone, i luoghi, le opere dâarte e gli eventi possano essere collegati attraverso relazioni etichettate, abilitando le macchine a ragionare su entità del mondo reale e le loro connessioni. Fonte
Un grafo della conoscenza ÃĻ un modo di organizzare le informazioni mappando cose del mondo reale come persone, aziende, eventi o idee in una rete di fatti collegati.
Ogni sub-entità ÃĻ un nodo, e i collegamenti tra loro (edge) descrivono come sono collegati. Ad esempio, âMicrosoftâ (un nodo) potrebbe essere collegato a âOpenAIâ (un altro nodo) da un edge che dice âÃĻ un cliente diâ. Questi collegamenti sono spesso archiviati in database grafici e seguono una struttura di soggetto-predicato-oggetto, come âMicrosoft ÃĻ un cliente di OpenAIâ.
Memoria Persistente
Uno studio cinese di settembre di questâanno ha proposto un metodo di formazione gratuito che utilizza il ragionamento basato su grafi per rilevare incoerenze sottili nei deepfake multimodali.
Invece di generare razionali o fine-tuning grandi modelli, il sistema recupera coppie di immagini e testi, costruisce un grafo di similarità e punteggia i collegamenti, al fine di recuperare gli esempi piÃđ pertinenti, e questi guidano il giudizio del modello senza la necessità di una nuova formazione:

Un panorama del framework GASP-ICL, che migliora il rilevamento dei deepfake combinando la selezione di campioni basata su grafi con lâapprendimento in contesto, consentendo a un modello di visione-linguaggio congelato di classificare le coppie di immagini/testo come reali o false, senza formazione o fine-tuning. Â Fonte
Questo ÃĻ probabilmente il lavoro piÃđ vicino, certamente quello che ho trovato, a un approccio âinformatoâ e consapevole della storia per la valutazione e la verifica della nuova produzione multimediale. Per la maggior parte, gli approcci di visione computerizzata continuano ad analizzare immagini (inclusi frame di video e anomalie temporali che abbracciano piÃđ frame) mentre i framework di rilevamento di âfake newsâ continuano a enfatizzare i dati basati sul testo, anche in progetti multimodali.
Creep delle Caratteristiche
La sfida di un sistema predittivo di questo tipo ÃĻ lâambito della sorveglianza che potrebbe essere necessario per rendere lâapproccio completamente performante â almeno al di là dellâanalisi dei personaggi famosi e delle figure pubbliche, per le quali esiste già dati liberamente accessibili.
Probabilmente il filone di ricerca piÃđ simile attuale ÃĻ il campo della pre-crime, che etichetta diversi segnali di intelligenza multimodale come âsospettiâ, e si presenta come un fantasma di AI coraggioso in uscite come Person of Interest (2011-2016) e Minority Report (2002).
Sebbene un sistema di sorveglianza onnivoro come Person of Interest produrrebbe risultati ottimali, ÃĻ improbabile che la cultura occidentale possa sanzionare il livello di intrusività personale che le reti interne cinesi impongono ai propri cittadini.
Pertanto, per quanto riguarda le notizie false sui non-personaggi famosi, solo le agenzie governative come la polizia (nonchÃĐ i registri di nascita e morte e gli uffici delle imposte) avrebbero abbastanza informazioni storiche pertinenti per informare le probabilità in un flusso di lavoro basato su grafi; e anche loro avrebbero bisogno di volontà , capacità , legislazione e risorse nello stile del CCCP per includere i cittadini comuni nella loro copertura e nelle loro analisi (cioÃĻ, al di là dei punti di dati banali ma obbligatori come i numeri di passaporto e le registrazioni di auto).
Punteggio di ProbabilitÃ
Sembra probabile che lâefficacia potenziale di un sistema di questo tipo sarebbe limitata ai casi di utilizzo piÃđ ovvi (attuali) per i contenuti deepfake: destabilizzazione (deepfake supportati dallo stato); deepfake di celebrità e âsconosciutiâ pornografici (che possono essere considerati entrambi maliziosi, sebbene il secondo caso tenda ad attirare una maggiore preoccupazione dei media); truffa (inclusi audio/video deepfake progettati per eseguire âfurti di identità â); e assassinio del carattere politico.
Un sistema basato sulla conoscenza avrebbe bisogno di una scala di probabilità per una varietà di eventi possibili. A unâestremità dello spettro, fallimenti umani comuni come la gestione finanziaria discutibile, lâinfedeltà , la dipendenza, la scorrettezza, ecc.; allâaltra estremità âĶ rivelare di essere il figlio di Dio in un programma di chat show live (o eventi di scala e impatto simili).
Anche in questâultimo caso, i fattori storici personali per un individuo peserebbero lâesito della probabilità : un personaggio politico di spicco che ha pubblicamente equivocato in questioni controverse (come la veridicità degli allunaggi lunari degli anni â60 e â70) per guadagnare capitale con un elettorato sempre piÃđ âinformato in modo alternativoâ potrebbe guadagnare uno status di wildcard aggiuntivo nelle routine di verifica, rispetto ai suoi colleghi piÃđ sobri.
Nel caso dei deepfake di celebrità , câÃĻ un contesto del mondo reale sufficiente (ad esempio, le fughe di foto di celebrità del 2012, tra gli altri â rari incidenti) per generare un moderato Liarâs Dividend, in certi contesti; ma poichÃĐ questi incidenti outlier tendono a funzionare come eccezioni che confermano la regola, la maggior parte dei deepfake di celebrità attuali basati sulla diffusione sarebbe considerata estremamente âimprobabileâ (anche se ciÃē non risolve il problema dellâappropriazione delle identità delle persone per tali scopi).
In termini di disastro nazionale, câÃĻ una notevole quantità di dati statistici che possono aiutare a valutare le probabilità di ârapporti disastrosiâ. Anche nella storia antica, eventi apparentemente âimprovvisiâ come lâeruzione del vulcano Vesuvio non identificato nel 79 d.C. erano stati preannunciati, se solo si fosse prestata sufficiente attenzione; e oltre la disponibilità di una moltitudine di feed supportati dal governo e da organizzazioni non governative, la capacità dellâAI di estrarre strutture da dati grezzi puÃē fornire ulteriore contesto storico per la valutazione della probabilità .
Conclusione
Anche un sistema predittivo ben implementato di questo tipo non potrebbe tener conto del caso, degli atti di Dio, degli eventi improvvisi o degli eventi maliziosi congegnati al di fuori di qualsiasi supervisione.
Inoltre, il volume e la profondità dei dati necessari per fornire copertura anche per le persone non famose sarebbero un punto di svolta politica â almeno per il momento.
Tuttavia, le scelte sembrano restringersi; lâanalisi basata sulla visione ÃĻ sul punto di fallire di fronte allâAI generativa migliorata, mentre i sistemi di verifica e di provenienza portano un onere di debito tecnico e di attrito contro lâadozione. CiÃē rende soluzioni come lâiniziativa di autenticità del contenuto e il sistema di copyright dei volti di Metaphysic.ai Metaphysic Pro difficili da popolarizzare.
Nel loro uso piÃđ ampio, i sistemi basati su RAG possono solo determinare se una fonte di autorità supporta unâaffermazione non verificata; e poichÃĐ molte grandi storie vere emergono senza contesto precedente, la mancanza di sostegno da parte di fonti di autorità non ÃĻ necessariamente significativa.
Il loro valore potrebbe dimostrarsi maggiore se potessero far parte di un ecosistema di dati piÃđ ampio che si occupa della cosa che la maggior parte delle forme attuali di AI trova difficile â il contesto storico.
Â
* Non da confondere con le prime uscite dellâautoencoder che debuttarono nel 2017 e sarebbero stati in seguito sostituiti da approcci superiori.
â https://arxiv.org/abs/2511.07009
** Which can usually run freely on more powerful home PCs, instead of only being available via gate-kept APIs such as ChatGPT and the Veo series.
â â â Omitting legitimate entertainment uses, such as professional visual effects in movie and TV productions.
Pubblicato per la prima volta giovedÃŽ 13 novembre 2025












