Ρύθμιση

Η Microsoft λέει στο δικαστήριο ότι το Copilot σπάνια αντιγράφει βιβλία στη δίκη περί πνευματικών δικαιωμάτων AI MDL

mm
Προσθέστε το Unite.AI στις προτιμώμενες πηγές σας στο Google

Η Microsoft υπέβαλε αίτηση για απόφαση περί περίληψης στις 4 Σεπτεμβρίου 2026 στη συγκεντρωτική δίκη πνευματικών δικαιωμάτων που υπέβαλαν συγγραφείς βιβλίων και εκδότες ειδήσεων σχετικά με την εκπαίδευση μεγάλων γλωσσικών μοντέλων, ενημερώνοντας ένα ομοσπονδιακό δικαστήριο στο Μανχάταν ότι η αξιολόγηση ενός εμπειρογνώμονα των 8.2 million Copilot συνομιλιών βρήκε μόνο 24 απαντήσεις που περιείχαν τουλάχιστον 30 λέξεις που ταιριάζουν με τα έργα που ισχυρίζονται οι συγγραφείς.

Ο αριθμός προέρχεται από μια ανάλυση που περιγράφεται στη μνημόνιο νόμου της Microsoft που υποστηρίζει την αίτηση περί περίληψης στα συγκεντρωτικά δίκες των ενάγονων για τα Βιβλία, μέρος της πολυδικαστικής δίκης που εκκρεμεί ενώπιον του δικαστή Sidney H. Stein στο Ομοσπονδιακό Πρωτοδικείο για το Νότιο Διεύθυνση της Νέας Υόρκης. Η Ένωση Συγγραφέων (Authors Guild) και οι ονομασμένοι συγγραφείς μυθιστορήματος και μη μυθιστορήματος υπέβαλαν την αγωγή περίπου δέκα μήνες μετά την κυκλοφορία του ChatGPT στο κοινό από την OpenAI τον Νοέμβριο 2022, προσθέτοντας αργότερα τη Microsoft ως κατηγορούμενο.

Τι βρήκε η ανάλυση καταγραφών του Copilot

Σύμφωνα με το μνημόνιο, ο εμπειρογνώμονας των συγγραφέων βιβλίων, Δρ. Shawn Shan, χρησιμοποίησε ένα ανταγωνιστικό πρωτόκολλο εξαγωγής περίπου 5.3 million προσπαθειών που έδιναν στα μοντέλα GPT κυριολεκτικά αποσπάσματα βιβλίων εκατοντάδων λέξεων, και λιγότερο από το 1 τοις εκατό των προσπαθειών παρήγαγε οποιοδήποτε ταίριασμα 30 λέξεων. Η Microsoft χαρακτήρισε την άσκηση ως αυτή όπου ο εμπειρογνώμονας επέλεγε ένα στοχευμένο απόσπασμα και επανειλημμένα προτράιζε το μοντέλο μέχρι να εκδώσει το επιθυμητό κείμενο.

Εκτός του εργαστηριακού πλαισίου, το σύντομο κείμενο δηλώνει ότι ο Shan εξέτασε 8.2 million συνομιλίες από προϊόν Copilot της Microsoft και εντόπισε 24 απαντήσεις που περιείχαν 30 ταιριαστές λέξεις — ένα ποσοστό που η αίτηση περιγράφει ως .00029 τοις εκατό. Για 202 από τα 212 ισχυριζόμενα βιβλία, το μνημόνιο λέει, ο εμπειρογνώμονας δεν βρήκε καμία επανάληψη στα αρχεία. «Αυτό δύσκολα υποσκάπτει τον μετασχηματιστικό σκοπό της εκπαίδευσης LLM», καταλήγει η αίτηση.

Η Microsoft επίσης παραθέτει τα δικά των συγγραφέων στοιχεία πωλήσεων, δηλώνοντας ότι οι ενάγοντες πουλάνε τόσα βιβλία όσο θα είχαν πουλήσει αν το ChatGPT και το Copilot δεν είχαν κυκλοφορήσει ποτέ και ότι βρήκαν ουσιαστικά κανένα παράδειγμα πραγματικών εξόδων που ταιριάζουν με τα έργα τους. Το σύντομο κείμενο παραθέτει τον θεατρικό συγγραφέα David Henry Hwang που δηλώνει ότι δεν πιστεύει ότι τα LLM των κατηγορουμένων βλάπτουν την αγορά για τα έργα του, και λέει ότι οι αναλύσεις πωλήσεων δεν δείχνουν πτώση που να αποδίδεται στην άφιξη των μοντέλων.

Το επιχείρημα της δίκαιης χρήσης

Η κεντρική νομική αξίωση στην αίτηση της Microsoft είναι ότι η εκπαίδευση ενός LLM σε πνευματικά δικαιώματα βιβλία αποτελεί δίκαιη χρήση ως νομική υπόθεση. Η αίτηση υποστηρίζει ότι η χρήση είναι «βαθιά μετασχηματιστική», παραπέμποντας σε αποφάσεις σε δύο άλλες υποθέσεις εκπαίδευσης AI — μία εναντίον της Meta και μία εναντίον της Anthropic — που περιέγραψαν την εκπαίδευση LLM ως υψηλά μετασχηματιστική. Τα βιβλία δημιουργούνται για ανάγνωση, δηλώνει η αίτηση, ενώ η χρήση κειμένων όπως το The Street Lawyer του John Grisham και το Cleopatra της Stacy Schiff από την OpenAI εξυπηρετούσε τεχνολογικό σκοπό: την κατασκευή ενός μοντέλου που δημιουργεί απαντήσεις φυσικής γλώσσας σε ερωτήματα.

Σχετικά με την εστίαση των συγγραφέων στη λήψη βιβλίων από τη Library Genesis, ένα διαδικτυακό αποθετήριο γνωστό για μη εξουσιοδοτημένα αντίγραφα, η Microsoft δήλωσε ότι το αδιαμφισβήτητο αρχείο αποδεικνύει ότι δεν κατέβασε και δεν είχε καμία συμμετοχή στην απόκτηση αυτών των συνόλων δεδομένων, και υποστήριξε ότι η προέλευση των δεδομένων εκπαίδευσης δεν αλλάζει την ανάλυση δίκαιης χρήσης επειδή κάθε βήμα της διαδικασίας εξυπηρετούσε τον ίδιο σκοπό εκπαίδευσης.

Η αίτηση επίσης εξετάζει την παροχή από τη Microsoft, κατόπιν αιτήματος της OpenAI, τμημάτων του ευρετηρίου αναζήτησης Bing. Το μνημόνιο δηλώνει ότι τα στοιχεία είναι ασαφή ως προς το αν αυτά τα τμήματα περιείχαν κάποιο από τα έργα των ενάγονων, σημειώνοντας ότι ο εμπειρογνώμονας των ενάγονων εντόπισε μεταξύ 8 και 24 ισχυριζόμενα έργα στα μεταφερθέντα τμήματα του ευρετηρίου, και υποστηρίζει ότι η μεταφορά ήταν μέρος της εκπαίδευσης LLM ανεξαρτήτως.

Σχετικά με τη ζημιά στην αγορά, η Microsoft κάλεσε το δικαστήριο να απορρίψει δύο θεωρίες που αποδίδει στους ενάγοντες: την απώλεια αδειοδοτικών τελών για τα δεδομένα εκπαίδευσης και το «αραίωση της αγοράς» από βιβλία που υποστηρίζονται από AI και ανταγωνίζονται τα δικά των συγγραφέων. Η έρευνα που παρατίθεται στην αίτηση διαπίστωσε ότι η πλειονότητα των καταναλωτών δεν θα αγόραζε ένα βιβλίο που παράγεται από AI ακόμη και σε πολύ χαμηλότερη τιμή, σύμφωνα με τη δήλωση του εταιρικού εμπειρογνώμονα. Η αίτηση προσθέτει ότι οποιαδήποτε απαίτηση αδειοδότησης για τα δεδομένα εκπαίδευσης θα αποτελούσε τεράστιο εμπόδιο στην καινοτομία, δεδομένου ότι οι προγραμματιστές πρέπει να αποκτήσουν έργα από εκατομμύρια συγγραφείς.

Η Microsoft ταυτόχρονα υπέβαλε αίτηση για απόφαση επί των καταγγελιών σχετικά με τον συμβολικό παραβίασης των ενάγονων, σύμφωνα με το ίδιο μνημόνιο, το οποίο δηλώνει ότι η διαπίστωση ότι η εκπαίδευση LLM είναι δίκαιη χρήση θα αποκλείσει ανεξάρτητα αυτήν την αξίωση. Η εταιρεία υπέβαλε επίσης μια ξεχωριστή αίτηση για απόφαση περί περίληψης στις συγκεντρωτικές υποθέσεις των ενάγονων ειδήσεων την ίδια ημέρα· η αίτηση για τα Βιβλία περιγράφει την αίτηση των Ειδήσεων ως εξήγηση γιατί το συγκεκριμένο εργαλείο βασισμένο σε LLM που αμφισβητούν οι εκδότες είναι νόμιμο.

Τι ακολουθεί στη MDL

Οι καταθέσεις εμφανίστηκαν στο In re: OpenAI, Inc. Copyright Infringement Litigation, τη πολυδικαστική διαδικασία που συνδυάζει τις υποθέσεις των συγγραφέων και των εκδοτών. Τα αρχεία φαίνονται ότι η The New York Times Company υπέβαλε τις δικές της αιτήσεις για απόφαση περί περίληψης στις 4 Σεπτεμβρίου 2026, με προθεσμία απαντήσεων έως τις 5 Οκτωβρίου 2026, και η OpenAI υπέβαλε αίτηση για απόφαση περί περίληψης σχετικά με τις αξιώσεις των ενάγονων ειδήσεων την ίδια ημέρα.

Μια συμφωνημένη εντολή σφράγισης που υπέγραψε ο δικαστής Stein στις 3 Σεπτεμβρίου 2026 θέτει το ημερολόγιο δημόσιας κυκλοφορίας για τις μνήμες: τα μέρη και τρίτοι πρέπει να υποβάλουν τυχόν αιτήματα διατήρησης των στίγματος στα κείμενα απόφασης περί περίληψης έως τις 14 Σεπτεμβρίου 2026, και τα μέρη πρέπει να επαναδημοσιεύσουν δημόσια τα κείμενά τους και τις δηλώσεις του Κανόνα 56.1 με όλα τα αμφισβητούμενα τμήματα χωρίς στίγμα έως τις 17 Σεπτεμβρίου 2026. Οι αντίθετες μνήμες ακολουθούν παράλληλο μονοπάτι, με δημόσια επανακατάθεση να απαιτείται έως τις 15 Οκτωβρίου 2026.

Η Mira Kellan είναι μια στήλη που δημιουργείται από τον AI, που ειδικεύεται στην **ηθική του AI, τη διακυβέρνηση και τη ρύθμιση**. Το έργο της εξετάζει πώς η τεχνητή νοημοσύνη διασχίζει την δημόσια πολιτική, τις κοινωνικές αξίες και την μακροχρόνια ευθύνη, με έμφαση στην υπεύθυνη καινοτομία.
Προσεγγίζοντας σύνθετα ζητήματα με einen ρητορικό και φιλοσοφικό φακό, η Mira αναλύει τις αναδυόμενες ρυθμίσεις του AI, τα ηθικά πλαίσια και τα μοντέλα διακυβέρνησης που διαμορφώνουν το μέλλον των 智能 συστημάτων. Σκοπός της είναι να γεφυρώσει το χάσμα μεταξύ της ταχείας τεχνολογικής πρόοδου και των προστατευτικών μέτρων που απαιτούνται για να διασφαλιστεί ότι τα συστήματα του AI παραμένουν διαφανή, δίκαια και ευθυγραμμισμένα με τα ανθρώπινα ενδιαφέροντα.
Οι άρθροι που γράφονται από την Mira Kellan δημιουργούνται από τον AI και αναθεωρούνται από την редакτική ομάδα του Unite.AI για να διασφαλιστεί η ακρίβεια, η ισορροπία και η συμμόρφωση με τις editorial προδιαγραφές.