Regulierung
USA TODAY verklagt OpenAI wegen urheberrechtlich geschützter Nachrichteninhalte im KI-Training

USA TODAY Co., Inc. und seine verbundenen Zeitungsunternehmen verklagten OpenAI am 8. Oktober 2026 vor einem Bundesgericht in New York und behaupteten, das Unternehmen habe seine GPT‑Modelle mit Hunderttausenden ihrer urheberrechtlich geschützten Artikel ohne Genehmigung trainiert und ihren Journalismus in Chatbot‑Ausgaben neu verpackt, die die Originale ersetzen. Die Klage verlangt Schadensersatz in Höhe von über $250 million.
Die Klageeinreichung und beantragte Abhilfe
Der Fall, USA Today Co., Inc. v. OpenAI Foundation, wurde beim U.S. District Court für den Southern District of New York von Rechtsanwalt Steven Lieberman von Rothwell, Figg, Ernst & Manbeck eingereicht. Die Klage wurde am 8. Oktober 2026 eingereicht, begleitet von einem Anhang mit Urheberrechtsregistrierungen und einem zweiten Anhang mit Beispielen der GPT-5.6‑Ausgaben, laut dem Gerichtsprotokoll. Am selben Tag enthalten die Docket‑Einträge ein Zivildeckblatt, ein Urheberrechtsmitteilungsformular, eine Anwesenheitsmitteilung und einen Antrag auf Ausstellung einer Vorladung.
Eine am selben Tag eingereichte Erklärung zur Zusammengehörigkeit bittet darum, dass die Klage als verbunden mit der konsolidierten OpenAI-Urheberrechtsverletzungsklage, die bereits vor demselben Gericht anhängig ist behandelt wird. Die Klageschrift stellt fest, dass die Kläger einer langen Liste von Urheberrechtsinhabern angehören, die OpenAI und andere KI‑Unternehmen verklagt haben, wobei viele dieser Fälle vor demselben Gericht konsolidiert wurden.
Nach dem von der Klageschrift zitierten gesetzlichen Rahmen können die Kläger bis zu $150,000 für jede vorsätzliche Urheberrechtsverletzung sowie bis zu $25,000 pro Verstoß wegen Entfernung von Copyright‑Management‑Informationen, also Eigentums‑ und Rechtsdaten, die veröffentlichten Werken beigefügt sind, geltend machen. Die Kläger behaupten, dass die Modelle von OpenAI Hunderttausende von Artikeln und anderen Materialien aus ihren Publikationen kopiert haben.
Vorwürfe zu Trainingsdaten und Kopieren
Laut der Klageschrift wurden die großen Sprachmodelle von OpenAI mit urheberrechtlich geschütztem Material trainiert, das ohne Genehmigung aus dem Internet gesammelt wurde, ungeachtet von Bezahlschranken oder anderen Zugriffsbeschränkungen, und OpenAI setzte Programme ein, die darauf ausgelegt waren, Copyright‑Management‑Informationen, die den Schutz der Werke anzeigen, zu entfernen. Die Klageschrift verweist zudem auf schriftliche Belege, die OpenAI im Dezember 2023 einer Untersuchung des britischen House of Lords vorlegte, in denen das Unternehmen erklärte, dass Urheberrecht praktisch jede Form menschlichen Ausdrucks abdecke und die Beschränkung der Trainingsdaten auf gemeinfreie Werke keine KI‑Systeme hervorbringen würde, die den aktuellen Bedürfnissen entsprechen.
Die Klageschrift gibt an, dass Inhalte aus den Publikationen der Kläger mehr als 160.000 Einträge im WebText‑Korpus enthalten, dem internen Datensatz, den OpenAI zum Training von GPT‑2 erstellt hat, darunter 83.266 Einträge von usatoday.com und 12.994 Einträge von freep.com. Sie stellt fest, dass die Domains der Publikationen mehr als 122 Millionen Token im C4‑Datensatz ausmachen, einem gefilterten englischsprachigen Teil eines Snapshots von 2019 des Common‑Crawl‑Webarchivs, und reproduziert OpenAIs veröffentlichtes GPT‑3‑Trainingsmix, bei dem Common Crawl mit 60 Prozent und WebText2, einer erweiterten Version des WebText‑Korpus, mit 22 Prozent gewichtet wurden.
Um zu argumentieren, dass OpenAI verstand, was seine Modelle enthielten, zitiert die Klage interne Kommunikation. Sie stellt fest, dass Mitbegründer Greg Brockman Kollegen mitteilte, die Modelle seien besonders gut darin, den Text von Nachrichtenartikeln vorherzusagen, und dass eine Präsentation aus dem Jahr 2020 des damaligen Forschungsleiters Dario Amodei die Nachrichtengenerierung zu den Fähigkeiten von GPT‑3 zählte. Sie zitiert den VP of Research von OpenAI mit den Worten: „Wir trainieren unsere Netzwerke, die Trainingsdaten zu memorieren – das ist ihr Ziel“, und verweist auf interne Nachrichten vom Juni 2022, in denen Mitarbeitende bestätigten, dass GPT‑4 eine große Menge an Daten memorisiert habe und sehr effektiv beim Wiedergeben sei.
Die Klageschrift behauptet weiter, dass Microsoft OpenAI über einen Zeitraum von drei Jahren eine Kopie des Bing‑Index zur Verfügung stellte, einer Zusammenstellung von Milliarden von Webseiten, die für Microsofts Suchmaschine gesammelt wurden und die Inhalte der Kläger enthielten, im Rahmen einer Initiative mit dem Codenamen Project Taxi, und dass Microsoft separat einen Crawler namens Project Mango für OpenAI entwickelte und betrieb, für den OpenAI Microsoft zahlte. Sie behauptet zudem, dass die Ausgabefilter von OpenAI Inhalte von keiner Partei unterdrückten, die das Unternehmen nicht verklagt hatte, ein Vorgehen, das ein Microsoft‑Manager intern als versehentliche Vertuschung bezeichnete.
Beispiele für GPT‑5.6‑Ausgaben
Die Einreichung reproduziert Beispiele, bei denen GPT‑5.6, aufgefordert, einen bestimmten Artikel anhand des Titels zu finden und zusammenzufassen, das von der Klageschrift als umfangreiche mehrteilige Zusammenfassungen beschrieben wird, die die Originale paraphrasieren und deren strukturelle Gliederung beibehalten. Die reproduzierten Beispiele betreffen Artikel der Indianapolis Star, der Detroit Free Press, des Knoxville News‑Sentinel, des Palm Beach Post, des Tennessean, des Enquirer, des Des Moines Register, des Courier‑Journal, des Naples Daily News, des Asbury Park Press, des Milwaukee Journal Sentinel, des Columbus Dispatch, des Oklahoman und des Star News, wobei vollständige Versionen als Anhang beigefügt sind.
Die Klage behauptet, OpenAI habe seine Modelle bewusst nachtrainiert, um urheberrechtlich geschützte Artikel zusammenzufassen, anstatt die Artikel selbst zurückzugeben, und dabei Ersatzprodukte geschaffen, die denselben informativen Zweck wie die Originale erfüllen. Sie zitiert den Leiter von ChatGPT bei OpenAI, der anerkennt, dass es nach einer Antwort von ChatGPT „keinen guten Grund gibt,“ auf einen Link zur zugrunde liegenden Quelle zu klicken, und führt die Aussage eines OpenAI‑Ingenieurs an, dass Nutzer unabhängig davon, wie prominent Links angezeigt werden, nicht klicken werden. Wenn die Ausgaben von OpenAI deren Inhalte reproduzieren oder neu verpacken, behaupten die Kläger, hätten die Nutzer keinen Grund, die Originalquellen zu besuchen oder ein Abonnement zu bezahlen.
Die Parteien
Die Kläger, alle im Besitz von USA TODAY Co., Inc., halten Urheberrechte an Inhalten, die von 19 Publikationen veröffentlicht wurden, darunter USA TODAY, The Tennessean, die Indy Star, The Bergen Record, The Enquirer, die Asbury Park Press, Democrat & Chronicle, The Knoxville News‑Sentinel, die Naples Daily News, The Oklahoman, der Milwaukee Journal Sentinel, The Columbus Dispatch, The Arizona Republic, The Courier‑Journal, The Des Moines Register, die Detroit Free Press, The Detroit News, The Palm Beach Post und die Star News. Die Klage beschreibt USA TODAY Co., ehemals Gannett Co., Inc., als ein diversifiziertes Medienunternehmen, dessen Geschichte bis ins Jahr 1906 zurückreicht, das USA TODAY und Hunderte von Tageszeitungen veröffentlicht, und stellt fest, dass seine Publikationen Dutzende von Pulitzer-Preisen gewonnen haben und Hunderte von Journalisten in dreizehn Bundesstaaten beschäftigen.
Die Beklagten sind OpenAI Foundation; OpenAI GP, LLC; OAI International, Inc.; OpenAI OpCo, LLC; OpenAI Global, LLC; OAI Corporation; und OpenAI Group PBC, die in der Klage jeweils als in San Francisco ansässige Einheiten beschrieben werden, die direkt in die angebliche Rechtsverletzung verwickelt waren oder davon profitiert haben. Die Klage berichtet von OpenAIs Rekapitalisierung am 28. Oktober 2025, durch die die gemeinnützige Organisation zur OpenAI Foundation wurde und Anteile an dem gewinnorientierten Unternehmen hielt, das OpenAI mit einem Wert von etwa 130 Milliarden Dollar bezifferte, und das gewinnorientierte Unternehmen wurde zu OpenAI Group PBC, einer Public‑Benefit‑Corporation. Unter Berufung auf OpenAIs eigene Angaben stellt die Klage fest, dass ChatGPT im März 2026 mehr als 900 Millionen wöchentliche aktive Nutzer und über 50 Millionen zahlende Abonnenten hatte.
Die streitgegenständlichen Modelle reichen von GPT‑1 bis GPT‑6.1 sowie GPT‑OSS und umfassen laut Klage alle Varianten Instant, Thinking, mini, nano und Pro. Die Kläger verlangen ein Schwurgerichtsverfahren.












