Regulace
Microsoft říká soudu, že Copilot zřídka reprodukuje knihy v AI autorském sporu MDL

Microsoft podal žádost o souhrnný rozsudek dne 4. září 2026 v konsolidovaném soudním sporu o autorská práva podaném autory knih a vydavateli zpráv kvůli trénování velkých jazykových modelů a sdělil federálnímu soudu v Manhattanu, že odborná revize 8,2 milionu Copilot konverzací zjistila pouze 24 odpovědí obsahujících alespoň 30 slov shodujících se s díly, která autoři uvádějí jako svá.
Číslo pochází z analýzy popsané v právním memorandu společnosti Microsoft, která podporuje její žádost o souhrnný rozsudek v konsolidovaných případech žalobců z oblasti knih, což je součástí multidistriktového sporu projednávaného před soudcem Sidneyem H. Steinem u Spojených států okresního soudu pro jižní okres New Yorku. Sdružení autorů a jmenovaní autoři beletrie i non‑beletrie podali žalobu zhruba deset měsíců po uvedení ChatGPT veřejnosti společností OpenAI v listopadu 2022 a později přidali Microsoft jako žalovaného.
Co zjistila analýza protokolu Copilot
Podle memoranda odborník jménem Dr. Shawn Shan, zastupující autory knih, použil protokol adversariálního extrahování přibližně 5,3 milionu pokusů, při nichž byly modelům GPT podávány doslovné úryvky z knih o stovkách slov, a méně než 1 procento těchto pokusů přineslo jakýkoli shodný úsek o 30 slovech. Microsoft charakterizoval tento postup jako takový, kde odborník vybral cílový úryvek a opakovaně model vyzýval, dokud nevygeneroval požadovaný text.
Mimo toto laboratorní prostředí, jak uvádí podání, Shan přezkoumal 8,2 milionu konverzací z produktu Copilot od Microsoftu a identifikoval 24 odpovědi obsahující 30 shodných slov — míra, kterou podání popisuje jako 0,00029 procenta. Pro 202 z 212 uvedených knih memorandum uvádí, že odborník v protokolech vůbec žádné opakování nenašel. „To téměř neoslabuje transformační účel tréninku LLM,“ uzavírá podání.
Microsoft také citoval prodejní důkazy autorů a uvádí, že žalobci prodávají stejně mnoho knih, jako by měli, kdyby ChatGPT a Copilot nikdy nebyly vydány, a že prakticky nenašli žádné příklady výstupů z reálného světa, které by odpovídaly jejich dílům. Podání cituje dramatika Davida Henryho Hwang, který prohlašuje, že nevěří, že LLM modely obžalovaných poškozují trh s jeho hrami, a uvádí, že analýzy prodejů neukazují žádný pokles přičitatelný příchodu modelů.
Argument o spravedlivém užití
Hlavní právní nárok v podání společnosti Microsoft spočívá v tom, že trénování LLM na chráněných knihách představuje spravedlivé užití podle zákona. Podání tvrdí, že použití je „hluboce transformativní“ a odkazuje na rozhodnutí ve dvou dalších případech AI tréninku – jeden proti Meta a druhý proti Anthropic – které popisovaly trénink LLM jako vysoce transformativní. Knihy jsou vytvořeny k četbě, uvádí podání, zatímco využití textů jako The Street Lawyer od Johna Grishama a Cleopatra od Stacy Schiff ze strany OpenAI sloužilo technologickému účelu: vytvoření modelu, který generuje odpovědi v přirozeném jazyce na podněty.
Když se autoři zaměřili na stahování knih OpenAI z Library Genesis, online úložiště známého tím, že obsahuje neautorizované kopie, Microsoft uvedl, že nediskutovatelný záznam prokazuje, že neprováděl stahování a nebyl zapojen do získávání těchto datových sad, a argumentoval, že původ tréninkových dat nemění analýzu spravedlivého užití, protože každý krok procesu sloužil stejnému tréninkovému účelu.
Podání také řeší poskytnutí částí indexu vyhledávače Bing společností Microsoft na žádost OpenAI. Memorandum uvádí, že důkazy jsou nejednoznačné, pokud jde o to, zda tyto části obsahovaly jakékoli díla žalobců, a poznamenává, že odborník žalobců identifikoval mezi 8 a 24 uváděnými díly v převedených částech indexu, a argumentuje, že převod byl součástí tréninku LLM bez ohledu na to.
Co se týče poškození trhu, Microsoft vyzval soud, aby odmítl dvě teorie, které přisuzuje žalobcům: ztrátu licenčních poplatků za tréninková data a „ředění trhu“ způsobené knihami vytvořenými pomocí AI, které soutěží s knihami samotných autorů. Výzkum citovaný v podání zjistil, že drtivá většina spotřebitelů by si AI‑generovanou knihu nekoupila ani za výrazně nižší cenu, podle odborné deklarace společnosti. Podání dále uvádí, že jakýkoli licenční požadavek na tréninková data by představoval obrovskou překážku pro inovace, vzhledem k tomu, že vývojáři musí získat díla milionů autorů.
Microsoft zároveň podal žádost o rozhodnutí o podání v souvislosti s počtem přispívajících k porušení ze strany žalobců, podle stejného memoranda, které uvádí, že uznání tréninku LLM jako spravedlivého užití by samostatně vyloučilo tento nárok. Společnost také podala samostatnou žádost o souhrnný rozsudek v konsolidovaných případech žalobců z oblasti zpráv tentýž den; její podání týkající se knih popisuje podání týkající se zpráv jako vysvětlení, proč je konkrétní nástroj založený na LLM, který vydavatelé napadají, zákonný.
Co bude dál v MDL
Podání byla zařazena do In re: OpenAI, Inc. Copyright Infringement Litigation, multidistriktového řízení spojujícího případy autorů a vydavatelů. Záznamy v spisu ukazují, že společnost The New York Times Company podala své vlastní žádosti o souhrnný rozsudek dne 4. září 2026, s odpověďmi splatnými do 5. října 2026, a OpenAI podala žádost o souhrnný rozsudek v nárocích žalobců z oblasti zpráv tentýž den.
A dohodnutý příkaz o utajení podepsaný soudcem Steinem dne 3. září 2026 stanoví kalendář veřejného zveřejnění podání: strany a třetí strany musí podat veškeré žádosti o zachování redakcí v souhrnných rozsudcích do 14. září 2026 a strany musí veřejně znovu podat své podání a prohlášení podle pravidla 56.1 se všemi nepochybnými částmi bez redakce do 17. září 2026. Opozice podání následují paralelní cestu, přičemž veřejné opětovné podání je vyžadováno do 15. října 2026.












