Reglementare

Microsoft spune instanței că Copilot reproduce rar cărți în MDL privind drepturile de autor AI

mm
Adaugă Unite.AI la sursele tale preferate pe Google

Microsoft a solicitat un rezumat al hotărârii pe 4 septembrie 2026 în litigiu consolidat privind drepturile de autor intentat de autori de cărți și editori de știri referitor la antrenarea modelelor lingvistice mari, informând o instanță federală din Manhattan că revizuirea efectuată de un expert a 8,2 milioane de conversații Copilot a identificat doar 24 de răspunsuri care conțineau cel puțin 30 de cuvinte ce se potriveau cu lucrările revendicate de autori.

Acest număr provine dintr-o analiză descrisă în memorandumul juridic al Microsoft care susține cererea sa de rezumat al hotărârii în cazurile consolidate ale reclamanților din sectorul cărților, parte a unui litigiu multidistrict aflat în fața judecătorului Sidney H. Stein la Tribunalul Districtual al SUA pentru Districtul Sudic al New York-ului. Asociația Autorilor și autorii de ficțiune și non-ficțiune numiți au intentat acțiunea aproximativ zece luni după ce OpenAI a lansat publicului ChatGPT în noiembrie 2022, adăugând ulterior Microsoft ca pârât.

Ce a constatat analiza jurnalului Copilot

Conform memorandumului, expertul autorilor de cărți, Dr. Shawn Shan, a utilizat un protocol de extragere adversarială de aproximativ 5,3 milioane de încercări care furnizau modelelor GPT pasaje de carte exacte, de sute de cuvinte, iar mai puțin de 1 procent din acele încercări au produs vreună potrivire de 30 de cuvinte. Microsoft a caracterizat exercițiul ca fiind unul în care expertul a selectat un pasaj țintă și a solicitat în mod repetat modelului până când a emis textul dorit.

În afara acelui cadru de laborator, documentul afirmă că Shan a revizuit 8,2 milioane de conversații din produsul Copilot al Microsoft și a identificat 24 de răspunsuri care conțineau 30 de cuvinte potrivite — o rată pe care depunerea o descrie ca .00029 la sută. Pentru 202 din cele 212 cărți revendicate, memorandumul spune că expertul nu a găsit nicio regurgitare în jurnale. „Acest lucru cu greu subminează scopul transformativ al antrenării LLM”, concluzionează documentul.

Microsoft a citat, de asemenea, dovezile de vânzări ale autorilor, afirmând că reclamanții vând la fel de multe cărți pe care le-ar fi vândut dacă ChatGPT și Copilot nu ar fi fost niciodată lansate și că au găsit practic niciun exemplu de rezultate din viața reală care să corespundă lucrărilor lor. Documentul citează dramaturgul David Henry Hwang, care declară că nu crede că LLM‑urile pârâților afectează piața pentru piesele sale, și spune că analizele de vânzări nu arată nicio scădere atribuită apariției modelelor.

Argumentul privind utilizarea corectă

Revendicarea juridică centrală din depunerea Microsoft este că antrenarea unui LLM pe cărți protejate prin drepturi de autor constituie o utilizare corectă din punct de vedere legal. Documentul susține că utilizarea este „profund transformatoare”, făcând referire la hotărâri din alte două cazuri de antrenare AI — unul împotriva Meta și unul împotriva Anthropic — care au descris antrenarea LLM ca fiind extrem de transformatoare. Cărțile sunt create pentru a fi citite, afirmă depunerea, în timp ce utilizarea de către OpenAI a textelor precum The Street Lawyer de John Grisham și Cleopatra de Stacy Schiff a servit unui scop tehnologic: construirea unui model care generează răspunsuri în limbaj natural la comenzi.

Referitor la concentrarea autorilor pe descărcarea de către OpenAI a cărților de pe Library Genesis, un depozit online cunoscut pentru conținerea de copii neautorizate, Microsoft a declarat că înregistrarea incontestabilă arată că nu a descărcat și nu a avut nicio implicare în obținerea acelor seturi de date, și a susținut că proveniența datelor de antrenament nu modifică analiza utilizării corecte, deoarece fiecare etapă a procesului a servit același scop de antrenament.

Depunerea abordează, de asemenea, furnizarea de către Microsoft, la cererea OpenAI, a unor porțiuni din indexul motorului de căutare Bing. Memorandumul afirmă că dovezile sunt inconcludente în ceea ce privește dacă acele porțiuni conțineau lucrări ale reclamanților, menționând că expertul reclamanților a identificat între 8 și 24 de lucrări revendicate în porțiunile transferate ale indexului, și susține că transferul a făcut parte din antrenarea LLM indiferent.

În ceea ce privește prejudiciul pe piață, Microsoft a îndemnat instanța să respingă două teorii atribuite reclamanților: pierderea taxelor de licențiere pentru datele de antrenament și „diluarea pieței” cauzată de cărțile asistate de AI care concurează cu cele ale autorilor. Cercetarea citată în depunere a constatat că majoritatea covârșitoare a consumatorilor nu ar achiziționa o carte generată de AI chiar și la un preț mult mai mic, conform declarației expertului companiei. Documentul adaugă că orice cerință de licențiere pentru datele de antrenament ar reprezenta o barieră enormă pentru inovație, având în vedere că dezvoltatorii trebuie să obțină lucrări de la milioane de autori.

Microsoft a solicitat, în același timp, o hotărâre pe baza plângerilor privind contorizarea infracțiunii contributive a reclamanților, conform aceluiași memorandum, care afirmă că constatarea că antrenarea LLM este o utilizare corectă ar respinge independent această revendicare. Compania a depus, de asemenea, o cerere separată de rezumat al hotărârii în cazurile consolidate ale reclamanților din sectorul știrilor în aceeași zi; documentul său privind cărțile descrie depunerea din sectorul știrilor ca explicând de ce instrumentul specific bazat pe LLM pe care editorii îl contestă este legal.

Ce urmează în MDL

Depunerile au fost înregistrate în In re: OpenAI, Inc. Copyright Infringement Litigation, procedura multidistrict care combină cazurile autorilor și editorilor. Înregistrările dosarului arată că The New York Times Company a depus propriile cereri de rezumat al hotărârii pe 4 septembrie 2026, cu răspunsuri scadente până la 5 octombrie 2026, iar OpenAI a depus o cerere de rezumat al hotărârii privind revendicările reclamanților din sectorul știrilor în aceeași zi.

O ordin de sigilare stipulat semnat de judecătorul Stein pe 3 septembrie 2026 stabilește calendarul de publicare a documentelor pentru raportare: părțile și terții trebuie să depună orice cerere de menținere a redactărilor în rezumatele hotărârilor până la 14 septembrie 2026, iar părțile trebuie să depună public nouă versiune a memoriilor și declarațiilor conform Regulei 56.1 cu toate părțile necontestate ne-redactate până la 17 septembrie 2026. Memorandrele de opoziție urmează o traiectorie paralelă, cu depunerea publică obligatorie până la 15 octombrie 2026.

Mira Kellan este o columnista generată de IA, specializată în etică IA, guvernanță și reglementare. Lucrările sale examinează modul în care inteligența artificială se intersectează cu politica publică, valorile societale și răspunderea pe termen lung, cu accent pe inovarea responsabilă.
Abordând probleme complexe cu o perspectivă rațională și filosofică, Mira analizează reglementările emergente ale IA, cadrele etice și modelele de guvernanță care modelează viitorul sistemelor inteligente. Ea își propune să acopere golul dintre progresul tehnologic rapid și garanțiile necesare pentru a asigura că sistemele IA rămân transparente, corecte și aliniate cu interesele umane.
Articolele scrise de Mira Kellan sunt generate de IA și revizuite de echipa editorială a Unite.AI pentru a asigura acuratețea, echilibrul și respectarea standardelor editoriale.