नियमन

OpenAI ने EU AI Act नियमों के तहत चरणबद्ध टेक्स्ट वॉटरमार्किंग शुरू किया

mm
Unite.AI को Google पर अपने पसंदीदा स्रोतों में जोड़ें

OpenAI ने 5 अक्टूबर, 2026 को टेक्स्ट वॉटरमार्किंग के प्रति अपना दृष्टिकोण प्रस्तुत किया EU AI Act के तहत, विश्वभर के API ग्राहकों के लिए विकल्प-आधारित वॉटरमार्किंग खोलते हुए और घोषणा की कि आने वाले हफ़्तों में यूरोपीय संघ में योग्य ChatGPT और Codex टेक्स्ट आउटपुट में अदृश्य वॉटरमार्क जोड़े जाएंगे।

EU AI Act जनरेटिव AI प्रदाताओं को उत्पन्न टेक्स्ट को मशीन-पठनीय तरीके से पहचानने योग्य बनाने की आवश्यकता करता है। OpenAI ने टेक्स्ट वॉटरमार्किंग और पहचान को प्रारंभिक तकनीकों के रूप में वर्णित किया, जिनमें महत्वपूर्ण सीमाएँ हैं, और कहा कि उनका चरणबद्ध दृष्टिकोण कानूनी आवश्यकताओं और उन सीमाओं दोनों को दर्शाता है।

विकल्प-आधारित API पहुँच और क्षेत्रीय EU रोलआउट

5 अक्टूबर, 2026 से, विश्वभर के API ग्राहक चयनित मॉडलों के लिए टेक्स्ट वॉटरमार्किंग को विकल्प-आधारित रूप से सक्रिय कर सकते हैं, और यह सेटिंग डिफ़ॉल्ट रूप से बंद रहती है। OpenAI ने कहा कि विकल्प-आधारित डिज़ाइन ग्राहकों को यह तय करने देता है कि वॉटरमार्किंग उनके पारदर्शिता दायित्वों और उपयोगकर्ताओं को प्रदान किए जाने वाले अनुभवों में कैसे फिट होती है, और वे क्लाउड साझेदारों के साथ मिलकर आने वाले हफ़्तों में उनके सेवाओं के माध्यम से एक्सेस किए जाने वाले OpenAI मॉडल आउटपुट के लिए वॉटरमार्किंग उपलब्ध कराने पर काम कर रहे हैं।

अपने स्वयं के उत्पादों के लिए, OpenAI केवल यूरोपीय संघ में सभी योजनाओं में योग्य ChatGPT और Codex उपयोगकर्ताओं के लिए टेक्स्ट वॉटरमार्किंग पेश करेगा, यह भी आने वाले हफ़्तों में। कंपनी ने कहा कि लॉन्च पर टेक्स्ट वॉटरमार्किंग को वैश्विक डिफ़ॉल्ट नहीं बनाया जा रहा है और क्षेत्रीय दृष्टिकोण उन्हें वास्तविक‑दुनिया के उपयोग और प्रतिक्रिया से सीखने की अनुमति देगा।

OpenAI ने 5 अक्टूबर, 2026 को अपने टेक्स्ट वॉटरमार्क डिटेक्टर तक पहुँच के लिए आवेदन भी खुले। पहुँच प्रारंभ में स्वीकृत शोधकर्ताओं और विशेषज्ञ संगठनों तक सीमित रहेगी, प्रत्येक केस को EU के Code of Practice on transparency of AI-generated content के अनुसार प्रदान किया जाएगा, ताकि टेक्स्ट स्रोतता के मूल्यांकन और सुधार का समर्थन किया जा सके। यह घोषणा केवल टेक्स्ट पर लागू होती है: OpenAI ने कहा कि ऑडियो और इमेज के लिए उनके सत्यापन उपकरण, जिसमें openai.com/verify वेब टूल और Content Provenance API शामिल हैं, सार्वजनिक रूप से उपलब्ध रहेंगे।

textGrain कैसे काम करता है

OpenAI की वॉटरमार्किंग तकनीक, textGrain, मॉडल द्वारा चुने गए शब्दों में एक अदृश्य सांख्यिकीय संकेत एम्बेड करती है, और कंपनी का डिटेक्टर उस संकेत के लिए एक अनुच्छेद का परीक्षण करता है ताकि यह निर्धारित किया जा सके कि उसमें OpenAI वॉटरमार्क है या नहीं। एक तकनीकी रिपोर्ट जिसका शीर्षक “textGrain: Entropy-Calibrated Watermarking for Language Model Text,” 5 अक्टूबर, 2026 की है, University of Pennsylvania, Yale University, और OpenAI से जुड़े लेखकों को सूचीबद्ध करती है।

रिपोर्ट के अनुसार, यह विधि टोकन जेनरेशन को कुंजी‑आधारित रैंडमनेस से जोड़ती है, एक ऑप्टिमल ट्रांसपोर्ट समस्या को हल करके जिसका लागत Gumbel रैंडम वेरिएबल्स से आती है, और Kullback–Leibler नियमितीकरण स्वतंत्रता से विचलन पर दंड लगाता है। एक एंट्रॉपी बजट वॉटरमार्क संकेत के बदले में छोड़ी गई औसत सैंपलिंग एंट्रॉपी को सीमित करता है, और रिपोर्ट बताती है कि KL दंड ठीक उसी औसत एंट्रॉपी के बराबर है जिसे वॉटरमार्क हटाता है, जिससे स्ट्रेंथ पैरामीटर को सीधे सूचना‑सिद्धांतिक अर्थ मिलता है। शब्दावली टोकन के कुंजी‑ब्लॉक पर ट्रांसपोर्ट चरण लागू करने से ऑप्टिमाइज़ेशन का आकार घट जाता है जबकि प्रत्येक ब्लॉक के भीतर सापेक्ष टोकन संभावनाएँ अपरिवर्तित रहती हैं। डिटेक्टर को केवल उत्पन्न टेक्स्ट और गुप्त कुंजी की आवश्यकता होती है, और जेनरेशन के दौरान उपयोग किए गए एंट्रॉपी बजट की नहीं।

OpenAI ने कहा कि वह इस तकनीक को ओपन सोर्स के रूप में जारी करने की योजना बना रहा है ताकि अन्य लोग इस पर निर्माण कर सकें, और रिपोर्ट को आने वाले हफ़्तों में अतिरिक्त विवरणों के साथ अपडेट किया जाएगा।

डिटेक्शन प्रदर्शन और घोषित सीमाएँ

OpenAI ने रिपोर्ट किया कि अपने मूल्यांकन में textGrain ने उन अन्य तरीकों के प्रदर्शन को मिलाया या उससे अधिक किया जिसे उसने परीक्षण किया, जिसमें टेक्स्ट के लिए SynthID भी शामिल है, जबकि यह चेतावनी दी कि आदर्श परिस्थितियों में मजबूत प्रदर्शन रोज़मर्रा के उपयोग में विश्वसनीय डिटेक्शन की गारंटी नहीं देता।

लक्ष्य फॉल्स पॉज़िटिव दर 1% पर, डिटेक्टर ने लगभग 80% 200‑टोकन वाले अनुच्छेदों और लगभग 95% 400‑टोकन वाले अनुच्छेदों में मनोविज्ञान जैसे कंटेंट के लिए वॉटरमार्क पहचाने, OpenAI ने रिपोर्ट किया, जबकि गणित जैसे कंटेंट के लिए दर काफी कम थी, जहाँ शब्द चयन कम लचीला होता है। 400‑टोकन अनुच्छेदों के एक मूल्यांकन में, शब्दों के 10% को पर्यायवाची से बदलने से डिटेक्शन लगभग 92% से 66% तक घट गया, और 25% शब्द बदलने से यह 17% तक गिर गया। इन मूल्यांकनों में ELI5 डेटासेट के प्रश्नों के उत्तर के रूप में वॉटरमार्क किए गए अंग्रेज़ी प्रतिक्रियाओं का उपयोग किया गया।

आउटपुट गुणवत्ता के बारे में, OpenAI ने कहा कि Astra का मूल्यांकन करने के लिए वह जिन बेंचमार्क्स का उपयोग करता है, जिसे वह अपना नवीनतम फ़्रंटियर मॉडल बताता है, वॉटरमार्किंग के साथ और बिना में वह कोई सार्थक प्रदर्शन अंतर नहीं देखता। उसके प्रकाशित तालिका में अनवॉटरमार्केड और वॉटरमार्केड टेक्स्ट के लिए क्रमशः Artificial Analysis Intelligence Index पर 49.57 और 49.76 अंक तथा GPQA Diamond पर 94.44% और 93.94% दर्शाए गए हैं। OpenAI ने कहा कि डिटेक्शन सीमाओं ने प्रारंभिक डिटेक्टर पहुँच को स्वीकृत शोधकर्ताओं और विशेषज्ञ संगठनों तक सीमित करने के उसके निर्णय में योगदान दिया।

वॉटरमार्क क्या स्थापित नहीं करता

OpenAI कहता है कि एक टेक्स्ट वॉटरमार्क उस भूमिका के बारे में सीमित संकेत प्रदान करता है जो उसके सिस्टम ने किसी अंश में निभाई। एक वॉटरमार्क मानव योगदान को मापता नहीं है, स्वामित्व या जिम्मेदारी स्थापित नहीं करता, उपयोगकर्ता की पहचान नहीं करता, और सटीकता की पुष्टि नहीं करता, कंपनी कहती है। यह भी कहा गया है कि पता न चलने वाला वॉटरमार्क मानव लेखन सिद्ध नहीं करता, क्योंकि टेक्स्ट बहुत छोटा, संपादित या अनुवादित हो सकता है जिससे विश्वसनीय पता लगाना कठिन हो, यह असमर्थित मॉडल से आ सकता है, वॉटरमार्किंग से पहले का हो सकता है, या किसी अन्य कंपनी के टूल्स द्वारा उत्पन्न हो सकता है।

डिटेक्टर यह रिपोर्ट करेगा कि क्या यह OpenAI वॉटरमार्क का पता लगाता है, बिना उपयोगकर्ता की पहचान किए या उनके प्रॉम्प्ट या वार्तालापों को उजागर किए। वॉटरमार्क मिस होने और फॉल्स पॉज़िटिव की संभावना को देखते हुए, OpenAI लॉन्च पर टूल को सार्वजनिक रूप से उपलब्ध नहीं कर रहा है।

EU पारदर्शिता दायित्व

AI अधिनियम के अनुच्छेद 50 के तहत पारदर्शिता दायित्व, जो AI‑जनित सामग्री की मार्किंग और डिटेक्शन तथा डीपफेक और कुछ AI‑जनित प्रकाशनों की लेबलिंग को कवर करते हैं, 2 अगस्त 2026 से लागू होते हैं। Code of Practice on Transparency of AI-generated Content को स्वतंत्र विशेषज्ञों ने AI ऑफिस द्वारा सुगम बहु‑हितधारक प्रक्रिया में तैयार किया, और अंतिम कोड 10 जून 2026 को प्रकाशित हुआ।

कोड का पालन स्वैच्छिक है, लेकिन अनुच्छेद 50 की पारदर्शिता आवश्यकताएँ कानूनी दायित्व हैं। आयोग और AI बोर्ड ने पुष्टि की है कि कोड अनुपालन दर्शाने के लिए एक पर्याप्त स्वैच्छिक उपकरण है, और जुलाई 2026 के अंत तक लगभग 190 कंपनियों और संगठनों ने आयोग के अनुसार कोड पर हस्ताक्षर किए थे।

OpenAI ने कहा कि वह डिटेक्शन को निरंतर सुधारता रहेगा, यह अध्ययन करेगा कि वॉटरमार्क संपादन और अनुवाद का सामना कैसे करते हैं, और AI सहायता को AI लेखन से अलग करने के तरीकों की खोज करेगा, तथा जब वह मानता है कि परिणामों की जिम्मेदार व्याख्या संभव है तो डिटेक्टर की पहुँच का विस्तार करेगा।

सोफी डेनार यूनाइट.एआई में एक एआई-जनरेटेड पत्रकार हैं, जो वैश्विक बाजारों में कृत्रिम बुद्धिमत्ता नीति, विनियमन और शासन को कवर करती हैं। उनका काम राष्ट्रीय और अंतर्राष्ट्रीय नियामक ढांचे के तरीके से एआई प्रौद्योगिकियों के विकास, तैनाती और व्यावसायीकरण को आकार देने पर केंद्रित है।

विदेश नीति और वैश्विक रूप से सूचित दृष्टिकोण के साथ, सोफी सरकारों, बहुपक्षीय संस्थानों और मानक निकायों से नीति पहलों को ट्रैक करती है, यह विश्लेषण करती है कि विभिन्न नियामक दृष्टिकोण नवाचार, प्रतिस्पर्धा और बाजार पहुंच को कैसे प्रभावित करते हैं। वह विशेष रूप से क्रॉस-बॉर्डर निहितार्थ, अनुपालन चुनौतियों और जोखिम प्रबंधन और प्रौद्योगिकी प्रगति के बीच संतुलन पर ध्यान देती है।

सोफी डेनार द्वारा लिखित लेख एआई-जनरेटेड हैं और यूनाइट.एआई की संपादकीय टीम द्वारा विश्वभर में एआई नीति और नियामक विकास की सटीकता, तटस्थता और जिम्मेदार कवरेज सुनिश्चित करने के लिए समीक्षा की जाती है।