Regolamentazione
USA TODAY denuncia OpenAI per contenuti giornalistici protetti da copyright nella formazione dell’IA

USA TODAY Co., Inc. e le sue entità giornalistiche affiliate hanno citato in giudizio OpenAI presso il tribunale federale di New York l’8 ottobre 2026, sostenendo che l’azienda ha addestrato i suoi modelli GPT su centinaia di migliaia dei loro articoli protetti da copyright senza autorizzazione e ha ricondotto il loro giornalismo in output di chatbot che sostituiscono gli originali. La causa richiede danni per oltre $250 million.
Il deposito e il rimedio richiesto
Il caso, USA Today Co., Inc. v. OpenAI Foundation, è stato depositato nel Tribunale Distrettuale degli Stati Uniti per il Southern District di New York dall’avvocato Steven Lieberman di Rothwell, Figg, Ernst & Manbeck. La denuncia è stata inserita l’8 ottobre 2026, accompagnata da un allegato di registrazioni di copyright e da un secondo allegato di esempi di output di GPT-5.6, secondo il fascicolo del tribunale. Le voci del fascicolo dello stesso giorno includono un foglio di copertina civile, un modulo di avviso di copyright, una notifica di comparizione e una richiesta di emissione di una citazione.
Una dichiarazione di correlazione depositata lo stesso giorno chiede che l’azione sia trattata come correlata al contenzioso per violazione del diritto d’autore contro OpenAI già pendente nello stesso tribunale. La denuncia afferma che i querelanti si uniscono a una lunga lista di titolari di copyright che hanno citato in giudizio OpenAI e altre società di IA, molti di questi casi consolidati in quel tribunale.
Ai sensi del quadro normativo citato nella denuncia, i querelanti possono recuperare fino a $150,000 per ogni violazione volontaria del copyright, più fino a $25,000 per violazione per la rimozione delle informazioni di gestione del copyright, i dati di proprietà e di diritti allegati alle opere pubblicate. I querelanti sostengono che i modelli di OpenAI hanno copiato centinaia di migliaia di articoli e altri materiali dalle loro pubblicazioni.
Accuse relative ai dati di addestramento e alla copia
Secondo la denuncia, i grandi modelli linguistici di OpenAI sono stati addestrati su materiale protetto da copyright prelevato da Internet senza autorizzazione, indipendentemente da paywall o altre restrizioni di accesso, e OpenAI ha utilizzato programmi progettati per rimuovere le informazioni di gestione del copyright che indicavano che le opere erano protette. La denuncia cita inoltre prove scritte che OpenAI ha presentato a un’inchiesta della Camera dei Lord britannica nel dicembre 2023, nella quale l’azienda ha dichiarato che, poiché il copyright copre praticamente ogni forma di espressione umana, limitare i dati di addestramento a opere di pubblico dominio non produrrebbe sistemi IA in grado di soddisfare le esigenze attuali.
La denuncia afferma che i contenuti delle pubblicazioni dei querelanti comprendono più di 160,000 voci in WebText, il corpus interno che OpenAI ha costruito per addestrare GPT-2, includendo 83,266 voci da usatoday.com e 12,994 voci da freep.com. Si afferma che i domini delle pubblicazioni rappresentano più di 122 milioni di token in C4, un sottoinsieme filtrato in lingua inglese di un’istantanea del 2019 dell’archivio web Common Crawl, e riproduce la combinazione di addestramento di GPT-3 pubblicata da OpenAI, che attribuiva al 60 percento a Common Crawl e al 22 percento a WebText2, una versione ampliata del corpus WebText.
Per dimostrare che OpenAI comprendeva ciò che i suoi modelli contenevano, la denuncia cita comunicazioni interne. Si afferma che il cofondatore Greg Brockman ha detto ai colleghi che i modelli erano particolarmente bravi a prevedere il testo degli articoli di notizie, e che una presentazione del 2020 del allora capo della ricerca Dario Amodei elencava la generazione di notizie tra le capacità di GPT-3. Cita il vicepresidente della Ricerca di OpenAI che dichiara: “Addestriamo le nostre reti a memorizzare i dati di addestramento — questo è il loro obiettivo”, e riporta messaggi interni di giugno 2022 in cui i dipendenti hanno riconosciuto che GPT-4 avrebbe memorizzato una grande quantità di dati e sarebbe stato altamente efficace nel rigurgitarli.
La denuncia afferma inoltre che, per un periodo di tre anni, Microsoft ha fornito a OpenAI una copia del Bing Index, una compilazione di miliardi di pagine web prelevate per il motore di ricerca di Microsoft che includeva i contenuti dei querelanti, nell’ambito di un’iniziativa denominata Project Taxi, e che Microsoft ha sviluppato e gestito separatamente un crawler chiamato Project Mango per conto di OpenAI, per il quale OpenAI ha pagato Microsoft. Si sostiene inoltre che i filtri di output di OpenAI non hanno sopresso i contenuti di alcuna entità che non avesse citato in giudizio l’azienda, un approccio che, secondo quanto affermato da un dirigente di Microsoft, è stato descritto internamente come una copertura accidentale.
Esempi di output di GPT-5.6
Il deposito riproduce esempi in cui GPT-5.6, sollecitato a trovare e riassumere un articolo specifico per titolo, ha prodotto quello che la denuncia descrive come estesi riassunti multi-sezione che parafrasano gli originali e ne seguono l’organizzazione strutturale. Gli esempi riprodotti riguardano articoli del Indianapolis Star, del Detroit Free Press, del Knoxville News-Sentinel, del Palm Beach Post, del Tennessean, del The Enquirer, del Des Moines Register, del Courier-Journal, del Naples Daily News, dell’Asbury Park Press, del Milwaukee Journal Sentinel, del Columbus Dispatch, del The Oklahoman e del Star News, con versioni complete allegate come allegato.
Il reclamo sostiene che OpenAI abbia addestrato deliberatamente i propri modelli a riassumere articoli protetti da copyright al posto di restituire gli articoli stessi, producendo sostituti che svolgono la stessa funzione informativa degli originali. Riporta le parole del responsabile di ChatGPT di OpenAI, il quale ammette che una volta che ChatGPT fornisce una risposta non c’è “alcun buon motivo per cliccare” su un collegamento alla fonte originale, e cita la dichiarazione di un ingegnere di OpenAI secondo cui, per quanto i collegamenti siano messi in evidenza, gli utenti non cliccheranno. Quando le uscite di OpenAI riproducono o ricombinano i contenuti, affermano i querelanti, gli utenti non hanno alcun motivo per visitare le fonti originali o pagare un abbonamento.
Le Parti
I querelanti, tutti di proprietà di USA TODAY Co., Inc., detengono i diritti d’autore sui contenuti pubblicati da 19 testate, tra cui USA TODAY, The Tennessean, l’Indy Star, The Bergen Record, The Enquirer, l’Asbury Park Press, il Democrat & Chronicle, The Knoxville News‑Sentinel, il Naples Daily News, The Oklahoman, il Milwaukee Journal Sentinel, The Columbus Dispatch, The Arizona Republic, The Courier‑Journal, The Des Moines Register, il Detroit Free Press, The Detroit News, The Palm Beach Post e il Star News. Il reclamo descrive USA TODAY Co., ex Gannett Co., Inc., come una società mediatica diversificata la cui storia risale al 1906, che pubblica USA TODAY e centinaia di quotidiani, e afferma che le sue testate hanno vinto decine di premi Pulitzer e impiegano centinaia di giornalisti in tredici stati.
I convenuti sono OpenAI Foundation; OpenAI GP, LLC; OAI International, Inc.; OpenAI OpCo, LLC; OpenAI Global, LLC; OAI Corporation; e OpenAI Group PBC, ciascuno descritto nel reclamo come un’entità con sede a San Francisco direttamente coinvolta o beneficiata della presunta violazione. Il reclamo ricorda la ricapitalizzazione di OpenAI del 28 ottobre 2025, con la quale l’organizzazione no‑profit è diventata OpenAI Foundation, detenendo partecipazioni nella società a scopo di lucro che OpenAI ha valutato intorno a 130 miliardi di dollari, e la società a scopo di lucro è divenuta OpenAI Group PBC, una corporation a beneficio pubblico. Citando le stesse dichiarazioni di OpenAI, il reclamo afferma che ChatGPT contava più di 900 milioni di utenti attivi settimanali e oltre 50 milioni di abbonati paganti a marzo 2026.
I modelli in questione comprendono GPT‑1 fino a GPT‑6.1 e GPT‑OSS, incluse tutte le varianti Instant, Thinking, mini, nano e Pro, secondo il reclamo. I querelanti chiedono un processo con giuria.












