Reglering

Microsoft säger till domstolen att Copilot sällan reproducerar böcker i AI‑upphovsrätt MDL

mm
Lägg till Unite.AI bland dina föredragna källor på Google

Microsoft yrkade om förenklad dom den 4 september 2026 i den samlade upphovsrättstviste som förts av bokförfattare och nyhetsförlag angående träning av stora språkmodeller, och meddelade en federal domstol i Manhattan att en expertrevision av 8,2 miljoner Copilot-konversationer endast fann 24 svar som innehöll minst 30 ord som matchade författarnas påstådda verk.

Siffran härrör från en analys som beskrivs i Microsofts rättsliga memorandum som stöder deras begäran om förenklad dom i författarnas samlade ärenden, en del av den multidistriktstvist som pågår inför domare Sidney H. Stein i den amerikanska distriktsdomstolen för södra New York. Authors Guild och namngivna skönlitterära och facklitterära författare stämde ungefär tio månader efter att OpenAI lanserade ChatGPT för allmänheten i november 2022, och lade senare till Microsoft som svarande.

Vad Copilot‑logganalysen fann

Enligt memorandumet använde författarnas expert, Dr. Shawn Shan, ett motståndskraftigt extraktionsprotokoll med ungefär 5,3 miljoner försök som matade GPT‑modellerna med bokstycken ordagrant, hundratals ord långa, och färre än 1 procent av dessa försök resulterade i någon 30‑ords‑matchning. Microsoft beskrev övningen som en där experten valde ett målstycke och upprepade gånger promptade modellen tills den levererade den önskade texten.

Utanför den laboratoriemiljön, enligt inlagan, granskade Shan 8,2 miljoner konversationer från Microsofts Copilot‑produkt och identifierade 24 svar som innehöll 30 matchande ord – en frekvens som inlagan beskriver som 0,00029 procent. För 202 av de 212 påstådda böckerna, enligt memorandumet, fann experten ingen återgivning i loggarna alls. ”Det undergräver knappt det transformerande syftet med LLM‑träning,” konstaterar inlagan.

Microsoft hänvisade också till författarnas egna försäljningsuppgifter och påstod att kärnarna säljer lika många böcker som de skulle ha gjort om ChatGPT och Copilot aldrig hade släppts, samt att de i praktiken inte fann några exempel på verkliga resultat som matchade deras verk. Inlagan citerar dramatikern David Henry Hwang som säger att han inte tror att svarandenas LLM‑er skadar marknaden för hans pjäser, och påstår att försäljningsanalyser visar ingen nedgång som kan hänföras till modellernas ankomst.

Argumentet om rättvis användning

Det centrala juridiska påståendet i Microsofts inlaga är att träning av en LLM på upphovsrättsskyddade böcker är rättvis användning enligt lag. Inlagan argumenterar för att användningen är ”grundligt transformerande” och hänvisar till domar i två andra AI‑träningstvister – en mot Meta och en mot Anthropic – som beskrev LLM‑träning som starkt transformerande. Böcker skapas för att läsas, skriver inlagan, medan OpenAIs användning av texter som John Grishams The Street Lawyer och Stacy Schiffs Cleopatra tjänade ett teknologiskt syfte: att bygga en modell som genererar naturliga språk‑svar på uppmaningar.

Angående författarnas fokus på OpenAIs nedladdning av böcker från Library Genesis, ett online‑arkiv känt för att innehålla obehöriga kopior, uppgav Microsoft att den obestridda dokumentationen visar att de inte laddade ner och inte hade någon inblandning i att skaffa dessa datamängder, och hävdade att ursprunget till träningsdata inte förändrar analysen av rättvis användning eftersom varje steg i processen tjänade samma träningssyfte.

Inlagan behandlar också Microsofts tillhandahållande, på OpenAIs begäran, av delar av Bing‑sökindexet. Memorandumet konstaterar att bevisen är otillräckliga för att avgöra om dessa delar innehöll något av kärnarnas verk, och noterar att kärnarnas expert identifierade mellan 8 och 24 påstådda verk i de överförda delarna av indexet, samt argumenterar för att överföringen ändå var en del av LLM‑träningen.

Angående marknadsskada uppmanade Microsoft domstolen att avvisa två teorier som de tillskriver kärnarna: förlorade licensavgifter för träningsdata och ”marknadsutspädning” från AI‑assistenterade böcker som konkurrerar med författarnas egna. Forskning som citeras i inlagan fann att en överväldigande majoritet av konsumenterna inte skulle köpa en AI‑genererad bok även till ett kraftigt lägre pris, enligt företagets expertdeklaration. Inlagan tillägger att ett licenskrav för träningsdata skulle utgöra ett enormt hinder för innovation, eftersom utvecklare måste införskaffa verk av miljontals författare.

Microsoft yrkade samtidigt om dom i svaromskrivningarna på kärnarnas påstående om medhjälpsam upphovsrättsintrång, enligt samma memorandum, som anger att ett fynd att LLM‑träning är rättvis användning skulle självständigt avvisa det påståendet. Företaget lämnade också in en separat begäran om förenklad dom i nyhetskärnarnas samlade ärenden samma dag; dess bok‑inlaga beskriver nyhetsinlagan som en förklaring till varför det specifika LLM‑baserade verktyg som förlagen ifrågasätter är lagligt.

Vad som blir nästa i MDL

Inlagorna hamnade i In re: OpenAI, Inc. Copyright Infringement Litigation, den multidistriktprocess som kombinerar författarnas och förläggarnas ärenden. Domstolsprotokollen visar att The New York Times Company lämnade in egna begäranden om förenklad dom den 4 september 2026, med svar förfallna den 5 oktober 2026, och att OpenAI lämnade in en begäran om förenklad dom i nyhetskärnarnas påståenden samma dag.

Ett avtalat sekretessorder undertecknat av domare Stein den 3 september 2026 fastställer den offentliga tidsplanen för inlämningarna: parter och tredje parter måste lämna in eventuella begäran om att behålla maskeringar i förenklade dom‑inlagor senast den 14 september 2026, och parterna måste offentligt återlämna sina inlagor och Rule 56.1‑uttalanden med alla omtvistade delar omarkerade senast den 17 september 2026. Oppositionsinlagor följer en parallell bana, med offentligt återlämnande som krävs senast den 15 oktober 2026.

Mira Kellan är en AI-genererad krönikör som specialiserar sig på AI-etik, styrning och reglering. Hennes arbete undersöker hur artificiell intelligens samverkar med offentlig politik, samhällsvärderingar och långsiktig ansvarighet, med fokus på ansvarsfull innovation.
Hon närmar sig komplexa frågor med ett rationellt och filosofiskt perspektiv, Mira analyserar nya AI-regler, etiska ramar och styrningsmodeller som formar framtiden för intelligenta system. Hon syftar till att överbrygga gapet mellan snabb teknisk utveckling och de skyddsåtgärder som behövs för att säkerställa att AI-system förblir transparenta, rättvisa och anpassade till mänskliga intressen.
Artiklar skrivna av Mira Kellan är AI-genererade och granskade av Unite.AIs redaktionella team för att säkerställa noggrannhet, balans och efterlevnad av redaktionella standarder.