नियमन

माइक्रोसॉफ्ट ने अदालत को बताया कि कोपायलट एआई कॉपीराइट MDL में पुस्तकें शायद ही पुनरुत्पादित करता है

mm
Unite.AI को Google पर अपने पसंदीदा स्रोतों में जोड़ें

माइक्रोसॉफ्ट ने 4 सितंबर, 2026 को बड़े भाषा मॉडलों के प्रशिक्षण को लेकर पुस्तक लेखकों और समाचार प्रकाशकों द्वारा दायर संयुक्त कॉपीराइट मुकदमे में सारांश निर्णय के लिए याचिका दायर की, और मैनहट्टन स्थित एक फेडरल कोर्ट को बताया कि 8.2 मिलियन कोपायलट वार्तालापों की एक विशेषज्ञ समीक्षा में केवल 24 प्रतिक्रियाएँ मिलीं जिनमें कम से कम 30 शब्द लेखक द्वारा दावा किए गए कार्यों से मेल खाते थे।

यह आंकड़ा माइक्रोसॉफ्ट के कानूनी स्मरणपत्र में वर्णित विश्लेषण से आया है, जो पुस्तकवादी वादी के संयुक्त मामलों में उसके सारांश निर्णय याचिका का समर्थन करता है, और यह यू.एस. डिस्ट्रिक्ट कोर्ट फॉर द साउदर्न डिस्ट्रिक्ट ऑफ़ न्यूयॉर्क में जज सिडनी एच. स्टीन के समक्ष चल रहे बहु‑क्षेत्रीय मुकदमे का हिस्सा है। लेखकों की गिल्ड और नामित काल्पनिक एवं गैर‑काल्पनिक लेखकों ने यह मुकदमा लगभग दस महीने बाद दायर किया, जब ओपनएआई ने नवंबर 2022 में चैटजीपीटी को सार्वजनिक रूप से लॉन्च किया, बाद में माइक्रोसॉफ्ट को प्रतिवादी के रूप में जोड़ा गया।

कोपायलट लॉग विश्लेषण ने क्या पाया

स्मरणपत्र के अनुसार, पुस्तक लेखकों के विशेषज्ञ डॉ. शॉन शैन ने लगभग 5.3 मिलियन प्रयासों का एक प्रतिद्वंद्वी निष्कर्षण प्रोटोकॉल उपयोग किया, जिसमें GPT मॉडलों को सशब्द पुस्तक अंश सौ शब्दों तक की लंबाई में फीड किया गया, और उन प्रयासों में से 1 प्रतिशत से भी कम ने कोई 30‑शब्दीय मेल उत्पन्न किया। माइक्रोसॉफ्ट ने इस अभ्यास को इस रूप में वर्णित किया कि विशेषज्ञ ने एक लक्ष्य अंश चुना और मॉडल को बार‑बार प्रॉम्प्ट किया जब तक कि वह इच्छित पाठ उत्पन्न न कर ले।

उस प्रयोगशाला सेटिंग के बाहर, संक्षिप्त विवरण में कहा गया है कि शैन ने माइक्रोसॉफ्ट के कोपायलट उत्पाद से 8.2 मिलियन वार्तालापों की समीक्षा की और 24 प्रतिक्रियाएँ पहचानीं जिनमें 30 मेल खाते शब्द थे — जिसे फाइलिंग .00029 प्रतिशत के रूप में वर्णित करती है। 212 दावे किए गए पुस्तकों में से 202 के लिए, स्मरणपत्र कहता है, विशेषज्ञ ने लॉग में कोई पुनरावृत्ति नहीं पाई। “यह LLM प्रशिक्षण के परिवर्तनकारी उद्देश्य को लगभग नहीं घटाता,” फाइलिंग निष्कर्ष निकालती है।

माइक्रोसॉफ्ट ने लेखकों के अपने बिक्री साक्ष्य भी उद्धृत किए, यह बताते हुए कि वादी उन पुस्तकों को उतनी ही मात्रा में बेच रहे हैं जितनी वे बेचते यदि चैटजीपीटी और कोपायलट कभी जारी न होते, और उन्होंने अपने कार्यों से मेल खाने वाले वास्तविक‑विश्व आउटपुट के लगभग कोई उदाहरण नहीं पाया। संक्षिप्त विवरण में नाटककार डेविड हेनरी हुआंग का उद्धरण है कि वह नहीं मानते कि प्रतिवादियों के LLM उनके नाटकों के बाजार को नुकसान पहुँचा रहे हैं, और कहा गया है कि बिक्री विश्लेषण दिखाते हैं कि मॉडलों के आगमन से कोई गिरावट नहीं हुई।

न्यायसंगत उपयोग तर्क

माइक्रोसॉफ्ट की फाइलिंग में मुख्य कानूनी दावा यह है कि कॉपीराइटेड पुस्तकों पर LLM का प्रशिक्षण कानूनी रूप से न्यायसंगत उपयोग है। संक्षिप्त विवरण तर्क देता है कि उपयोग “गहन रूप से परिवर्तनकारी” है, और दो अन्य AI प्रशिक्षण मामलों — एक मेटा के खिलाफ और एक एंथ्रोपिक के खिलाफ — के फैसलों की ओर इशारा करता है, जिन्होंने LLM प्रशिक्षण को अत्यधिक परिवर्तनकारी बताया। फाइलिंग कहती है कि पुस्तकें पढ़ने के लिए बनाई जाती हैं, जबकि ओपनएआई द्वारा जॉन ग्रिशम की The Street Lawyer और स्टेसी शिफ़ की Cleopatra जैसे पाठों का उपयोग तकनीकी उद्देश्य के लिए किया गया था: एक ऐसा मॉडल बनाना जो प्रॉम्प्ट पर प्राकृतिक भाषा प्रतिक्रियाएँ उत्पन्न करे।

लेखकों के इस बात पर ध्यान केंद्रित करने के संबंध में कि ओपनएआई ने लाइब्रेरी जेनिसिस से पुस्तकें डाउनलोड कीं, जो अनधिकृत प्रतियों के लिए जाना जाता ऑनलाइन रिपॉजिटरी है, माइक्रोसॉफ्ट ने कहा कि निर्विवाद रिकॉर्ड दर्शाता है कि उसने डाउनलोड नहीं किया और उन डेटासेट्स को प्राप्त करने में कोई भागीदारी नहीं थी, और तर्क दिया कि प्रशिक्षण डेटा की उत्पत्ति न्यायसंगत उपयोग विश्लेषण को नहीं बदलती क्योंकि प्रक्रिया के प्रत्येक चरण ने वही प्रशिक्षण उद्देश्य पूरा किया।

फाइलिंग माइक्रोसॉफ्ट की इस बात को भी संबोधित करती है कि ओपनएआई के अनुरोध पर उसने बिंग सर्च इंजन इंडेक्स के कुछ हिस्से प्रदान किए। स्मरणपत्र कहता है कि यह प्रमाण अस्पष्ट है कि उन हिस्सों में वादियों के कार्य शामिल थे या नहीं, यह नोट करते हुए कि वादियों के विशेषज्ञ ने इंडेक्स के स्थानांतरित हिस्सों में 8 से 24 दावे किए गए कार्य पहचाने, और तर्क देता है कि वह स्थानांतरण भी LLM प्रशिक्षण का हिस्सा था।

बाजार को नुकसान के संबंध में, माइक्रोसॉफ्ट ने अदालत से दो सिद्धांतों को खारिज करने का आग्रह किया जो वह वादियों को सौंपता है: प्रशिक्षण डेटा के लिए खोई हुई लाइसेंसिंग फीस, और “बाजार पतला होना” AI‑सहायता प्राप्त पुस्तकों के लेखकों की अपनी पुस्तकों के साथ प्रतिस्पर्धा करने से। फाइलिंग में उद्धृत शोध ने पाया कि अधिकांश उपभोक्ता AI‑जनित पुस्तक को भी बहुत कम कीमत पर नहीं खरीदेंगे, कंपनी के विशेषज्ञ के बयान के अनुसार। संक्षिप्त विवरण यह भी जोड़ता है कि प्रशिक्षण डेटा के लिए कोई भी लाइसेंसिंग आवश्यकता नवाचार के लिए एक विशाल बाधा होगी, क्योंकि डेवलपर्स को लाखों लेखकों के कार्य प्राप्त करने पड़ेंगे।

माइक्रोसॉफ्ट ने समान स्मरणपत्र के अनुसार वादियों के सहयोगी उल्लंघन के दावे पर याचिकाओं के लिए भी याचिका दायर की, जिसमें कहा गया है कि LLM प्रशिक्षण को न्यायसंगत उपयोग मानने से वह दावा स्वतंत्र रूप से समाप्त हो जाएगा। कंपनी ने उसी दिन समाचार वादियों के संयुक्त मामलों में सारांश निर्णय के लिए एक अलग याचिका भी दायर की; उसके पुस्तक संबंधी संक्षिप्त विवरण में बताया गया है कि समाचार फाइलिंग यह समझाती है कि प्रकाशकों द्वारा चुनौती दिया गया विशिष्ट LLM‑आधारित उपकरण वैध क्यों है।

MDL में आगे क्या होगा

फाइलिंग्स In re: OpenAI, Inc. Copyright Infringement Litigation में दर्ज हुईं, जो लेखकों और प्रकाशकों के मामलों को मिलाने वाली बहु‑क्षेत्रीय कार्यवाही है। डॉकेट रिकॉर्ड दिखाते हैं कि द न्यूयॉर्क टाइम्स कंपनी ने 4 सितंबर, 2026 को अपनी स्वयं की सारांश निर्णय याचिकाएँ दायर कीं, जिनके उत्तर 5 अक्टूबर, 2026 तक देने हैं, और ओपनएआई ने उसी दिन समाचार वादियों के दावों पर सारांश निर्णय याचिका दायर की।

जज स्टीन द्वारा 3 सितंबर, 2026 को हस्ताक्षरित एक निर्धारित सीलिंग आदेश ब्रीफिंग के सार्वजनिक‑रिलीज़ कैलेंडर को निर्धारित करता है: पक्षों और तृतीय पक्षों को 14 सितंबर, 2026 तक सारांश निर्णय ब्रीफ़ों में रेडैक्शन बनाए रखने के लिए कोई भी अनुरोध दाखिल करना होगा, और पक्षों को 17 सितंबर, 2026 तक सभी अनचुने हिस्सों को बिना रेडैक्शन के सार्वजनिक रूप से पुनः‑फ़ाइल करना होगा। विरोधी ब्रीफ़ समानांतर ट्रैक का पालन करेंगे, जिसमें सार्वजनिक पुनः‑फ़ाइलिंग 15 अक्टूबर, 2026 तक आवश्यक होगी।

मीरा केल्लन एक एआई-जनरेटेड कॉलम्निस्ट हैं जो एआई नैतिकता, शासन, और नियमन में विशेषज्ञता रखती हैं। उनका काम यह देखता है कि कैसे कृत्रिम बुद्धिमत्ता सार्वजनिक नीति, सामाजिक मूल्यों, और दीर्घकालिक जिम्मेदारी के साथ परस्पर क्रिया करती है, जिसमें जिम्मेदार नवाचार पर ध्यान केंद्रित किया जाता है।
जटिल मुद्दों पर एक तर्कसंगत और दार्शनिक दृष्टिकोण के साथ पहुंचते हुए, मीरा उभरते एआई नियमन, नैतिक ढांचे, और शासन मॉडलों का विश्लेषण करती हैं जो बुद्धिमान प्रणालियों के भविष्य को आकार दे रहे हैं। वह तेजी से तकनीकी प्रगति और एआई प्रणालियों को पारदर्शी, न्यायसंगत, और मानव हितों के साथ संरेखित रखने के लिए आवश्यक सुरक्षा उपायों के बीच की खाई को पाटने का लक्ष्य रखती हैं।
मीरा केल्लन द्वारा लिखित लेख एआई-जनरेटेड हैं और यूनाइट.एआई की संपादकीय टीम द्वारा सटीकता, संतुलन, और संपादकीय मानकों के अनुरूप होने के लिए समीक्षा की जाती हैं।