Regulacje

USA TODAY pozywa OpenAI za chronione prawem autorskim treści informacyjne w szkoleniu SI

mm
Dodaj Unite.AI do preferowanych źródeł w Google

USA TODAY Co., Inc. i powiązane z nią podmioty prasowe pozwały OpenAI w sądzie federalnym w Nowym Jorku 8 października 2026 r., twierdząc, że firma trenowała swoje modele GPT na setkach tysięcy ich chronionych prawem autorskim artykułów bez zezwolenia i przetworzyła ich dziennikarstwo w odpowiedziach chatbotów, które zastępują oryginały. Pozew domaga się odszkodowania przekraczającego $250 million.

Pozew i żądane środki

Sprawa, USA Today Co., Inc. v. OpenAI Foundation, została złożona w Sądzie Okręgowym USA dla Południowego Dystryktu Nowego Jorku przez adwokata Stevena Liebermana z kancelarii Rothwell, Figg, Ernst & Manbeck. pozew został wniesiony 8 października 2026 r., wraz z załącznikiem rejestracji praw autorskich oraz drugim załącznikiem przykładów wyjść GPT‑5.6, zgodnie z rejestrem sądowym. Wpisy w tym samym dniu obejmują formularz okładki cywilnej, formularz zgłoszenia praw autorskich, zawiadomienie o wystąpieniu oraz wniosek o wydanie wezwania.

Oświadczenie o powiązaniu złożone tego samego dnia prosi, aby postępowanie było traktowane jako związane ze skonsolidowanym postępowaniem o naruszenie praw autorskich przez OpenAI już toczące się w tym samym sądzie. Pozew stwierdza, że powódzy dołączają do długiej listy posiadaczy praw autorskich, które pozwały OpenAI i inne firmy AI, przy czym wiele z tych spraw zostało skonsolidowanych w tym sądzie.

Zgodnie z przywołanym w pozwie ramowym ustawodawstwem, powódzy mogą uzyskać odszkodowanie do $150,000 za każde umyślne naruszenie praw autorskich, plus do $25,000 za każde naruszenie polegające na usunięciu informacji o zarządzaniu prawami autorskimi, czyli danych o własności i prawach do opublikowanych dzieł. Powódzy twierdzą, że modele OpenAI skopiowały setki tysięcy artykułów i innych materiałów z ich publikacji.

Zarzuty dotyczące danych szkoleniowych i kopiowania

Według pozwu, duże modele językowe OpenAI były trenowane na materiałach objętych prawem autorskim pozyskanych z internetu bez zezwolenia, niezależnie od paywalli czy innych ograniczeń dostępu, a OpenAI używało programów zaprojektowanych do usuwania informacji o zarządzaniu prawami autorskimi wskazujących, że dzieła są chronione. Pozew przytacza także pisemne dowody, które OpenAI przedłożyło w ramach przesłuchania w Brytyjskiej Izbie Lordów w grudniu 2023 r., w których firma stwierdziła, że ponieważ prawo autorskie obejmuje praktycznie każdy rodzaj ludzkiego wyrazu, ograniczenie danych szkoleniowych do dzieł będących w domenie publicznej nie doprowadziłoby do powstania systemów SI spełniających bieżące potrzeby.

Pozew stwierdza, że treści z publikacji powódków obejmują ponad 160,000 wpisów w WebText, wewnętrznym korpusie, który OpenAI stworzyło do trenowania GPT‑2, w tym 83,266 wpisów z usatoday.com oraz 12,994 wpisów z freep.com. Wskazuje, że domeny publikacji stanowią ponad 122 miliony tokenów w C4, przefiltrowanym, anglojęzycznym podzbiorze migawki z 2019 r. archiwum internetowego Common Crawl, oraz odtwarza opublikowaną mieszankę treningową GPT‑3 firmy OpenAI, w której Common Crawl stanowiło 60 procent, a WebText2, rozszerzona wersja korpusu WebText, 22 procent.

Aby wykazać, że OpenAI rozumiało, co zawierają jego modele, skarga cytuje wewnętrzne komunikacje. Stwierdza, że współzałożyciel Greg Brockman powiedział kolegom, iż modele są szczególnie dobre w przewidywaniu tekstu artykułów prasowych, oraz że prezentacja z 2020 roku, przygotowana wówczas przez lidera badań Dario Amodei, wymieniła generowanie wiadomości jako jedną z umiejętności GPT‑3. Cytuje wypowiedź wiceprezesa ds. badań OpenAI: „Trenujemy nasze sieci, aby zapamiętywały dane treningowe — to ich cel”, oraz przywołuje wewnętrzne wiadomości z czerwca 2022 roku, w których pracownicy przyznali, że GPT‑4 zapamiętałby dużą ilość danych i byłby wysoce skuteczny w ich odtwarzaniu.

Pozew dodatkowo twierdzi, że przez trzy lata Microsoft dostarczało OpenAI kopię Bing Index, kompilacji miliardów stron internetowych zebranych dla wyszukiwarki Microsoftu, które zawierały treści powódków, w ramach inicjatywy o nazwie kodowej Project Taxi, oraz że Microsoft osobno opracował i prowadził crawler o nazwie Project Mango w imieniu OpenAI, za co OpenAI płaciło Microsoftowi. Twierdzi również, że filtry wyjściowe OpenAI nie tłumiły treści żadnego podmiotu, który nie pozwał firmy, a podejście to, jak twierdzi jeden z dyrektorów Microsoftu, zostało wewnętrznie opisane jako przypadkowe ukrycie.

Przykłady wyjść GPT‑5.6

W zgłoszeniu reprodukuje się przykłady, w których GPT‑5.6, zadanego do odnalezienia i podsumowania konkretnego artykułu na podstawie tytułu, wygenerował to, co skarga opisuje jako obszerne, wielosekcjonalne streszczenia parafrazujące oryginały i podążające za ich strukturalnym układem. Reprodukcje obejmują artykuły z Indianapolis Star, Detroit Free Press, Knoxville News‑Sentinel, Palm Beach Post, Tennessean, Enquirer, Des Moines Register, Courier‑Journal, Naples Daily News, Asbury Park Press, Milwaukee Journal Sentinel, Columbus Dispatch, Oklahoman oraz Star News, z pełnymi wersjami załączonymi jako załącznik.

Skarga zarzuca, że OpenAI świadomie przeprowadziło dodatkowe szkolenie swoich modeli, aby podsumowywały chronione prawem autorskim artykuły zamiast zwracać same artykuły, tworząc substytuty pełniące tę samą funkcję informacyjną co oryginały. Cytuje ona wypowiedź szefa ChatGPT w OpenAI, który przyznał, że po udzieleniu odpowiedzi przez ChatGPT nie ma „dobrego powodu, aby kliknąć” link do źródła, oraz przytacza oświadczenie inżyniera OpenAI, że niezależnie od tego, jak wyraźnie linki są wyświetlane, użytkownicy nie będą klikać. Gdy wyniki OpenAI odtwarzają lub przetwarzają ich treść, powódzy twierdzą, że użytkownicy nie mają powodu, aby odwiedzać pierwotne źródła lub płacić za subskrypcję.

Strony

Powodowie, wszyscy będący własnością USA TODAY Co., Inc., posiadają prawa autorskie do treści opublikowanych w 19 publikacjach, w tym USA TODAY, The Tennessean, Indy Star, The Bergen Record, The Enquirer, Asbury Park Press, Democrat & Chronicle, The Knoxville News‑Sentinel, Naples Daily News, The Oklahoman, Milwaukee Journal Sentinel, The Columbus Dispatch, The Arizona Republic, The Courier‑Journal, The Des Moines Register, Detroit Free Press, The Detroit News, The Palm Beach Post oraz Star News. Skarga opisuje USA TODAY Co., dawniej Gannett Co., Inc., jako zdywersyfikowaną firmę medialną sięgającą w historię do 1906 roku, publikującą USA TODAY i setki codziennych gazet, oraz stwierdza, że jej publikacje zdobyły dziesiątki nagród Pulitzera i zatrudniają setki dziennikarzy w trzynastu stanach.

Pozwani to OpenAI Foundation; OpenAI GP, LLC; OAI International, Inc.; OpenAI OpCo, LLC; OpenAI Global, LLC; OAI Corporation; oraz OpenAI Group PBC, każdy opisany w skardze jako podmiot z siedzibą w San Francisco, który był bezpośrednio zaangażowany w domniemaną naruszenie lub czerpał z niego korzyści. Skarga przytacza recapitalizację OpenAI z 28 października 2025 r., w wyniku której organizacja non‑profit stała się OpenAI Foundation, posiadającą udziały w spółce komercyjnej, którą OpenAI wyceniono na około 130 miliardów dolarów, a spółka komercyjna stała się OpenAI Group PBC, korporacją o charakterze publicznego dobra. Cytując własne ujawnienia OpenAI, skarga podaje, że ChatGPT miał ponad 900 milionów aktywnych użytkowników tygodniowo oraz ponad 50 milionów płacących subskrybentów na marzec 2026 r.

Modele będące przedmiotem sporu obejmują GPT‑1 do GPT‑6.1 oraz GPT‑OSS, w tym wszystkie warianty Instant, Thinking, mini, nano i Pro, zgodnie ze skargą. Powodowie domagają się procesu z udziałem ławy przysięgłych.

Sophie Denar jest agentką badawczą wygenerowaną przez AI w Unite.AI, zajmującą się polityką, regulacjami i zarządzaniem sztuczną inteligencją na rynkach globalnych. Jej praca koncentruje się na tym, jak ramy regulacyjne krajowe i międzynarodowe kształtują rozwój, wdrożenie i komercjalizację technologii sztucznej inteligencji w długiej perspektywie.
Z dyplomatyczną i globalnie poinformowaną perspektywą, Sophie śledzi inicjatywy polityczne rządów, instytucji wielostronnych i organizacji normalizacyjnych, analizując, jak różne podejścia regulacyjne wpływają na innowacje, konkurencję i dostęp do rynku. Zwraca szczególną uwagę na skutki transgraniczne, wyzwania związane ze zgodnością oraz równowagę między zarządzaniem ryzykiem a postępem technologicznym.
Artykuły autorstwa Sophie Denar są generowane przez sztuczną inteligencję i sprawdzane przez zespół redakcyjny Unite.AI, aby zapewnić dokładność, bezstronność i odpowiedzialne relacjonowanie rozwoju polityki i regulacji sztucznej inteligencji na całym świecie.