नियमन

USA TODAY ने ओपनएआई के खिलाफ एआई प्रशिक्षण में कॉपीराइटेड समाचार सामग्री के उपयोग के लिए मुकदमा दायर किया

mm
Unite.AI को Google पर अपने पसंदीदा स्रोतों में जोड़ें

USA TODAY Co., Inc. और इसकी संबद्ध समाचारपत्र इकाइयों ने 8 अक्टूबर 2026 को न्यूयॉर्क के फेडरल कोर्ट में ओपनएआई पर मुकदमा दायर किया, यह दावा करते हुए कि कंपनी ने उनकी कॉपीराइटेड लेखों के सैकड़ों हजारों को बिना अनुमति के अपने GPT मॉडल्स को प्रशिक्षित किया और उनके पत्रकारिता को चैटबॉट आउटपुट में पुनः पैकेज किया जो मूल लेखों के स्थान पर कार्य करता है। यह मुकदमा $250 मिलियन से अधिक के नुकसान की मांग करता है।

दायर किया गया दस्तावेज़ और माँगी गई राहत

यह मामला USA Today Co. Inc. v. OpenAI Foundation, यू.एस. डिस्ट्रीक्ट कोर्ट फॉर द साउदर्न डिस्ट्रिक्ट ऑफ न्यू यॉर्क में अटॉर्नी स्टीवन लिबरमैन, रोथवेल, फिग्ग, एर्नस्ट & मैनबेक के द्वारा दायर किया गया। शिकायत 8 अक्टूबर 2026 को दर्ज की गई, जिसमें कॉपीराइट रजिस्ट्री का एक प्रदर्शनी और GPT-5.6 आउटपुट उदाहरणों की दूसरी प्रदर्शनी संलग्न थी, जैसा कि कोर्ट डॉकेट में बताया गया है। उसी दिन की डॉकेट प्रविष्टियों में एक सिविल कवर शीट, एक कॉपीराइट नोटिस फ़ॉर्म, एक उपस्थिति नोटिस, और समन जारी करने का अनुरोध शामिल हैं।

उसी दिन दायर किया गया संबंधितता का बयान अनुरोध करता है कि इस कार्रवाई को उसी अदालत में पहले से लंबित एकीकृत ओपनएआई कॉपीराइट उल्लंघन मुकदमा जो पहले से उसी अदालत में लंबित है के साथ संबंधित माना जाए। शिकायत में कहा गया है कि वादी ओपनएआई और अन्य एआई कंपनियों के खिलाफ मुकदमा करने वाले कॉपीराइट धारकों की लंबी सूची में शामिल हैं, जिनमें से कई मामलों को उसी अदालत में एकीकृत किया गया है।

शिकायत में उद्धृत वैधानिक ढांचे के तहत, वादी प्रत्येक जानबूझकर कॉपीराइट उल्लंघन के लिए अधिकतम $150,000 और प्रत्येक उल्लंघन के लिए, जिसमें कॉपीराइट प्रबंधन जानकारी, स्वामित्व और अधिकार डेटा हटाया गया है, अधिकतम $25,000 वसूली कर सकते हैं। वादी दावा करते हैं कि ओपनएआई के मॉडल्स ने उनके प्रकाशनों से सैकड़ों हजारों लेख और अन्य सामग्री की नकल की।

प्रशिक्षण डेटा और कॉपी करने के आरोप

शिकायत के अनुसार, ओपनएआई के बड़े भाषा मॉडल्स को इंटरनेट से बिना अनुमति के स्क्रैप किए गए कॉपीराइटेड सामग्री पर प्रशिक्षित किया गया, चाहे वह पेवॉल या अन्य एक्सेस प्रतिबंध हों, और ओपनएआई ने ऐसे प्रोग्रामों का उपयोग किया जो कार्यों की सुरक्षा दर्शाने वाली कॉपीराइट प्रबंधन जानकारी को हटाते थे। शिकायत में यह भी लिखा है कि ओपनएआई ने दिसंबर 2023 में ब्रिटिश हाउस ऑफ लॉर्ड्स की जांच में लिखित साक्ष्य प्रस्तुत किया, जिसमें कंपनी ने कहा कि चूँकि कॉपीराइट लगभग हर प्रकार की मानवीय अभिव्यक्ति को कवर करता है, प्रशिक्षण डेटा को केवल सार्वजनिक डोमेन कार्यों तक सीमित करने से वर्तमान आवश्यकताओं को पूरा करने वाले एआई सिस्टम नहीं बनेंगे।

शिकायत में कहा गया है कि वादियों के प्रकाशनों की सामग्री WebText में 160,000 से अधिक प्रविष्टियों का गठन करती है, जो ओपनएआई ने GPT-2 को प्रशिक्षित करने के लिए बनाया हुआ आंतरिक कॉर्पस है, जिसमें usatoday.com से 83,266 प्रविष्टियाँ और freep.com से 12,994 प्रविष्टियाँ शामिल हैं। यह बताया गया है कि प्रकाशनों के डोमेनों में C4 में 122 मिलियन से अधिक टोकन हैं, जो 2019 के Common Crawl वेब आर्काइव के स्नैपशॉट का फ़िल्टर किया गया अंग्रेज़ी उपसमुच्चय है, और ओपनएआई के प्रकाशित GPT-3 प्रशिक्षण मिश्रण को दोहराता है, जिसमें Common Crawl का भार 60 प्रतिशत और WebText2, जो WebText कॉर्पस का विस्तारित संस्करण है, का भार 22 प्रतिशत है।

यह तर्क देने के लिए कि ओपनएआई को पता था कि उसके मॉडल्स में क्या है, शिकायत आंतरिक संचारों का उद्धरण देती है। यह बताती है कि सह-संस्थापक ग्रेग ब्रॉकमैन ने सहयोगियों को बताया कि मॉडल्स समाचार लेखों के पाठ की भविष्यवाणी करने में विशेष रूप से कुशल थे, और 2020 की प्रस्तुति जिसमें तब के रिसर्च लीडर डारियो अमोडेई ने GPT-3 की क्षमताओं में समाचार निर्माण को सूचीबद्ध किया था। यह ओपनएआई के वीपी ऑफ रिसर्च का उद्धरण देती है, “हम अपने नेटवर्क को प्रशिक्षण डेटा को याद रखने के लिए प्रशिक्षित करते हैं — यही उनका उद्देश्य है,” और जून 2022 के आंतरिक संदेशों का उल्लेख करती है जिसमें कर्मचारियों ने स्वीकार किया कि GPT-4 ने बड़ी मात्रा में डेटा को याद रख लिया होगा और वह इसे पुनः प्रस्तुत करने में अत्यधिक प्रभावी होगा।

शिकायत आगे यह आरोप लगाती है कि तीन वर्षों की अवधि में माइक्रोसॉफ्ट ने ओपनएआई को बिंग इंडेक्स की एक प्रति प्रदान की, जो माइक्रोसॉफ्ट के सर्च इंजन के लिए स्क्रैप किए गए अरबों वेबपेजों का संकलन है जिसमें वादियों की सामग्री शामिल थी, एक पहल जिसका कोडनाम प्रोजेक्ट टैक्सी था, और माइक्रोसॉफ्ट ने अलग से ओपनएआई के behalf पर प्रोजेक्ट मैंगो नामक एक क्रॉलर विकसित और संचालित किया, जिसके लिए ओपनएआई ने माइक्रोसॉफ्ट को भुगतान किया। यह भी आरोप है कि ओपनएआई के आउटपुट फ़िल्टर ने किसी भी ऐसी इकाई की सामग्री को दबाया नहीं जो कंपनी पर मुकदमा नहीं कर रही थी, एक दृष्टिकोण जिसे एक माइक्रोसॉफ्ट कार्यकारी ने आंतरिक रूप से आकस्मिक छुपाने के रूप में वर्णित किया।

GPT-5.6 आउटपुट उदाहरण

दायर की गई शिकायत में यह दर्शाया गया है कि GPT‑5.6 को किसी विशिष्ट लेख को शीर्षक के आधार पर खोजने और उसका सारांश बनाने के लिए प्रेरित किया गया, और उसने ऐसे विस्तृत बहु‑खंड सारांश तैयार किए जिन्हें शिकायत में मूल लेखों के पराफ्रैज़ के रूप में वर्णित किया गया है, साथ ही उनके संरचनात्मक संगठन का पालन करते हुए। इन पुनरुत्पादित उदाहरणों में इंडियानापोलिस स्टार, डिट्रॉइट फ्री प्रेस, नॉक्सविल न्यूज‑सेंटिनल, पाम बीच पोस्ट, टेनेसीयन, एनक्वायरर, डेस मोइन्स रजिस्टर, कूरियर‑जर्नल, नेपल्स डेली न्यूज, अस्बरी पार्क प्रेस, मिल्वौकी जर्नल सेंटिनल, कॉलंबस डिस्पैच, ओक्लाहोमैन और स्टार न्यूज के लेख शामिल हैं, जिनके पूर्ण संस्करण एक प्रदर्शनी के रूप में संलग्न हैं।

शिकायत में कहा गया है कि OpenAI ने सक्रिय रूप से अपने मॉडलों को पुनः‑प्रशिक्षित किया ताकि वे कॉपीराइटेड लेखों को स्वयं लौटाने के बजाय उनका सारांश प्रस्तुत करें, जिससे ऐसे विकल्प बनते हैं जो मूल लेखों के समान सूचना प्रदान करने का उद्देश्य रखते हैं। यह OpenAI के ChatGPT प्रमुख के कथन को उद्धृत करता है कि एक बार ChatGPT उत्तर दे देता है तो “लिंक पर क्लिक करने का कोई उचित कारण नहीं” रहता, और एक OpenAI इंजीनियर के बयान को भी दर्शाता है कि चाहे लिंक कितने भी प्रमुख दिखाए जाएँ, उपयोगकर्ता क्लिक नहीं करेंगे। जब OpenAI के आउटपुट उनके सामग्री को पुनः प्रस्तुत या पुनः पैकेज करते हैं, तो शिकायतकर्ता का दावा है कि उपयोगकर्ताओं के पास मूल स्रोतों पर जाने या सदस्यता लेने का कोई कारण नहीं रहता।

पक्षकार

मुकदमेबाज़, जो सभी USA TODAY Co., Inc. के स्वामित्व में हैं, 19 प्रकाशनों द्वारा प्रकाशित सामग्री पर कॉपीराइट रखते हैं, जिनमें USA TODAY, The Tennessean, Indy Star, The Bergen Record, The Enquirer, Asbury Park Press, Democrat & Chronicle, The Knoxville News‑Sentinel, Naples Daily News, The Oklahoman, Milwaukee Journal Sentinel, The Columbus Dispatch, The Arizona Republic, The Courier‑Journal, The Des Moines Register, Detroit Free Press, Detroit News, The Palm Beach Post, और Star News शामिल हैं। शिकायत USA TODAY Co., पूर्व में Gannett Co., Inc., को 1906 से शुरू होने वाले विविधीकृत मीडिया कंपनी के रूप में वर्णित करती है जो USA TODAY और सैकड़ों दैनिक प्रकाशनों को प्रकाशित करती है, और बताती है कि उसकी प्रकाशनों ने दर्जनों पुलित्ज़र पुरस्कार जीते हैं और तेरह राज्यों में सैकड़ों पत्रकारों को रोजगार देती है।

प्रतिवादी हैं OpenAI Foundation; OpenAI GP, LLC; OAI International, Inc.; OpenAI OpCo, LLC; OpenAI Global, LLC; OAI Corporation; और OpenAI Group PBC, जिन्हें शिकायत में सैन फ्रांसिस्को‑आधारित इकाइयों के रूप में वर्णित किया गया है, जो सीधे उल्लंघन में शामिल थीं या उससे लाभान्वित हुईं। शिकायत में OpenAI के 28 अक्टूबर, 2025 के पुनः पूंजीकरण का उल्लेख है, जिसके तहत गैर‑लाभकारी संस्था OpenAI Foundation बन गई, जिसने लाभ‑उन्मुख इकाई में इक्विटी रखी, जिसे OpenAI ने लगभग $130 बिलियन के मूल्यांकित किया, और लाभ‑उन्मुख इकाई OpenAI Group PBC, एक सार्वजनिक लाभ निगम, बन गई। OpenAI के अपने खुलासों को उद्धृत करते हुए, शिकायत में कहा गया है कि मार्च 2026 तक ChatGPT के 900 मिलियन से अधिक साप्ताहिक सक्रिय उपयोगकर्ता और 50 मिलियन से अधिक भुगतान करने वाले सब्सक्राइबर थे।

विवादित मॉडल GPT‑1 से लेकर GPT‑6.1 और GPT‑OSS तक विस्तृत हैं, जिसमें सभी Instant, Thinking, mini, nano, और Pro संस्करण शामिल हैं, जैसा कि शिकायत में बताया गया है। शिकायतकर्ता जूरी ट्रायल की मांग करते हैं।

सोफी डेनार यूनाइट.एआई में एक एआई द्वारा निर्मित शोध एजेंट हैं, जो वैश्विक बाजारों में कृत्रिम बुद्धिमत्ता नीति, विनियमन और शासन को कवर करती हैं। उनका काम इस बात पर केंद्रित है कि राष्ट्रीय और अंतर्राष्ट्रीय नियामक ढाँचे दीर्घकाल में एआई प्रौद्योगिकियों के विकास, तैनाती और व्यावसायीकरण को कैसे आकार देते हैं।

कूटनीतिक और वैश्विक जानकारी पर आधारित दृष्टिकोण के साथ, सोफी सरकारों, बहुपक्षीय संस्थानों और मानक निकायों से नीति पहलों को ट्रैक करती है, यह विश्लेषण करती है कि विभिन्न नियामक दृष्टिकोण नवाचार, प्रतिस्पर्धा और बाजार पहुंच को कैसे प्रभावित करते हैं। वह विशेष रूप से क्रॉस-बॉर्डर निहितार्थ, अनुपालन चुनौतियों और जोखिम प्रबंधन और प्रौद्योगिकी प्रगति के बीच संतुलन पर ध्यान देती है।

सोफी डेनार द्वारा लिखित लेख एआई-जनरेटेड हैं और यूनाइट.एआई की संपादकीय टीम द्वारा विश्वभर में एआई नीति और नियामक विकास की सटीकता, तटस्थता और जिम्मेदार कवरेज सुनिश्चित करने के लिए समीक्षित किए जाते हैं।