Sääntely
Microsoft kertoo oikeudelle, että Copilot harvoin toistaa kirjoja AI:n tekijänoikeus‑MDL:ssä

Microsoft haki yhteenvetotuomiota 4. syyskuuta 2026 konsolidoidussa tekijänoikeusriita‑käsittelyssä, jonka ovat nostaneet kirjailijat ja uutisjulkaisijat suurten kielimallien koulutuksesta, ja kertoi Manhattanissa sijaitsevalle liittovaltion tuomioistuimelle, että asiantuntijan tarkastelu 8,2 miljosta Copilot-keskustelusta löysi vain 24 vastausta, joissa oli vähintään 30 sanaa, jotka vastasivat tekijöiden väitettyjä teoksia.
Luku perustuu analyysiin, joka on kuvattu Microsoftin oikeudellisessa muistiossa tukemassa sen yhteenvetotuomiohakemusta kirjailijoiden valittajien konsolidoiduissa tapauksissa, osa monialuetta käsittelevästä oikeusprosessista, joka on vireillä tuomari Sidney H. Steinin edessä Yhdysvaltain eteläisen New Yorkin piirikunnan liittovaltion käräjäoikeudessa. Authors Guild ja nimettyjä kaunokirjallisuuden sekä tietokirjallisuuden tekijöitä haettiin kymmenen kuukautta OpenAI:n julkistettua ChatGPT:n marraskuussa 2022, ja myöhemmin Microsoft lisättiin vastaajaksi.
Mitä Copilot‑lokianalyysi löysi
Muistion mukaan kirjailijoiden asiantuntija, tohtori Shawn Shan, käytti noin 5,3 miljoonaa yritystä sisältävää vastustavaa poimintaprotokollaa, jossa syötettiin GPT-malleille kirjaotteita satojen sanojen pituisina tarkkoina lainauksina, ja vähemmän kuin 1 % näistä yrityksistä tuotti 30‑sanan vastaavuutta. Microsoft kuvasi harjoituksen sellaisena, jossa asiantuntija valitsi kohdeotteen ja kehoitti mallia toistuvasti, kunnes se tuotti halutun tekstin.
Tuo laboratoriotilanne pois jättäen, asiakirjassa todetaan, että Shan tarkasteli 8,2 miljoonaa keskustelua Microsoftin Copilot‑tuotteesta ja löysi 24 vastausta, joissa oli 30 vastaavaa sanaa — nopeus, jonka hakemus kuvaa .00029 prosentiksi. 212:sta väitetystä kirjasta 202:ssa asiantuntija ei lainkaan löytänyt lokitiedoista toistoa. “Se tuskin heikentää LLM‑koulutuksen muuntavan tarkoituksen,” asiakirja päättää.
Microsoft viittasi myös tekijöiden omiin myyntitodisteisiin, toteuttaen, että valittajat myyvät yhtä monta kirjaa kuin he olisivat myyneet, jos ChatGPT:tä ja Copilotia ei olisi koskaan julkaistu, eikä heillä ole käytännössä lainkaan esimerkkejä todellisista tuotoksista, jotka vastaisivat heidän teoksiaan. Asiakirjassa lainataan näytelmäkirjailija David Henry Hwangia, joka toteaa etteivät vastaajien LLM:t vahingoita hänen näytelmiensä markkinoita, ja väittää, että myyntianalyysit eivät näytä mallien saapumiseen liittyvää laskua.
Reilun käytön argumentti
Microsoftin hakemuksen keskeinen oikeudellinen väite on, että LLM:n kouluttaminen tekijänoikeudella suojattuihin kirjoihin on lain mukaan reilua käyttöä. Asiakirja väittää, että käyttö on “syvästi muuntavaa”, viitaten kahden muun AI‑koulutustapauksen – yhden Metaa vastaan ja toisen Anthropicia vastaan – päätöksiin, joissa LLM‑koulutus kuvattiin erittäin muuntavaksi. Kirjat on luotu luettaviksi, todetaan hakemuksessa, kun taas OpenAI:n tekstikäyttö, kuten John Grishamin teos The Street Lawyer ja Stacy Schiffin Cleopatra, palvelee teknologista tarkoitusta: mallin rakentamista, joka tuottaa luonnollisen kielen vastauksia kehotteisiin.
Kun tekijät keskittyvät OpenAI:n kirjahakuihin Library Genesis -verkkovarastosta, joka tunnetaan luvattomista kopioista, Microsoft totesi, että kiistämätön tieto osoittaa, ettei se ladannut aineistoja eikä ollut mukana niiden hankinnassa, ja väitti, että koulutusdatan alkuperä ei muuta reilun käytön analyysiä, koska jokainen prosessin vaihe palvelee samaa koulutustarkoitusta.
Hakemus käsittelee myös Microsoftin tarjoamaa osaa Bing-hakukoneen indeksistä OpenAI:n pyynnöstä. Muistio toteaa, että todisteet eivät ole ratkaisevia sen suhteen, sisälsikö ne osat valittajien teoksia, ja mainitsee, että valittajien asiantuntija tunnisti 8–24 väitettyä teosta siirretyissä indeksin osissa, ja väittää, että siirto oli osa LLM‑koulutusta riippumatta.
Markkinahaittojen osalta Microsoft kehotti tuomioistuinta hylkäämään kaksi valittajien esittämää teoriaa: koulutusdatan menetetyt lisenssimaksut ja “markkinan laimeneminen” AI‑avusteisten kirjojen kilpaillessa tekijöiden omien kanssa. Hakemuksessa viitattu tutkimus osoitti, että ylivoimainen suurin osa kuluttajista ei ostaisi AI‑luotua kirjaa edes merkittävästi alhaisemmalla hinnalla, yrityksen asiantuntijalausunnon mukaan. Asiakirja lisää, että mikä tahansa lisenssivaatimus koulutusdatasta olisi valtava este innovaatiolle, koska kehittäjien on hankittava miljoonien tekijöiden teoksia.
Microsoft haki samanaikaisesti tuomiota valitusten perusteella valittajien avustavan loukkauksen lukuun, saman muistion mukaan, jonka mukaan LLM‑koulutuksen todistaminen reiluksi käytöksi sulkisi kyseisen väitteen itsenäisesti. Yritys myös jätti erillisen yhteenvetotuomiohakemuksen uutisvalittajien konsolidoiduissa tapauksissa samana päivänä; sen Kirjat‑hakemus kuvaa Uutisten hakemusta selittäen, miksi julkaisijat kyseenalaistama erityinen LLM‑pohjainen työkalu on laillinen.
Mitä on seuraavana MDL:ssä
Hakemukset päätyivät In re: OpenAI, Inc. Copyright Infringement Litigation -tapausasiakirjoihin, monialueprosessiin, joka yhdistää tekijöiden ja julkaisijoiden tapaukset. Oikeusrekisteri osoittaa, että The New York Times Company jätti omat yhteenvetotuomiohakemuksensa 4. syyskuuta 2026, vastaukset määräaikaan 5. lokakuuta 2026, ja OpenAI jätti yhteenvetotuomiohakemuksen Uutisvalittajien vaatimuksiin samana päivänä.
Tuomari Steinin 3. syyskuuta 2026 allekirjoittama sopimuksellinen salausmääräys asettaa julkisen julkaisuaikataulun asiakirjoille: osapuolten ja kolmansien osapuolten on toimitettava kaikki pyynnöt yhteenvetotuomiohakemusten sensurointien ylläpitämiseksi 14. syyskuuta 2026 mennessä, ja osapuolten on julkisesti toimitettava uudelleen hakemuksensa ja Rule 56.1 -lausuntonsa, joissa kaikki kiistämättömät osat on poistettu sensuroinnista 17. syyskuuta 2026 mennessä. Vastustushakemukset noudattavat rinnakkaista aikataulua, ja julkinen uudelleentäydennys on vaadittava 15. lokakuuta 2026 mennessä.












