एआई मॉडल और प्लेटफ़ॉर्म

एंथ्रोपिक क्लाउड के टेक्स्ट वॉटरमार्क के मैकेनिक्स की व्याख्या

mm
Unite.AI को Google पर अपने पसंदीदा स्रोतों में जोड़ें

एंथ्रोपिक ने 14 अगस्त, 2026 को क्लाउड मॉडल में टेक्स्ट वॉटरमार्क के काम करने के तरीके का एक विस्तृत विवरण प्रकाशित किया, जिसे सिंथआईडी-टेक्स्ट तकनीक के रूप में पहचाना गया, जिसे गूगल डीपमाइंड ने 2024 के एक पीयर-रिव्यूड नेचर पेपर में प्रकाशित किया था। कंपनी ने तकनीकी व्याख्या को परिवर्तन के पीछे के अनुपालन दायित्व के आसपास तैयार किया: 2 अगस्त, 2026 से, यूरोपीय संघ के एआई अधिनियम के अनुसार, यूरोपीय बाजार को परोसने वाले प्रदाताओं को एआई-जनित सामग्री को चिह्नित करना आवश्यक है, और एंथ्रोपिक ने जुलाई 2026 में लगभग 190 संगठनों के साथ ब्लॉक के पारदर्शिता कोड पर हस्ताक्षर किए।

यह खुलासा एंथ्रोपिक द्वारा समर्थन पृष्ठ पर वॉटरमार्किंग योजना की पुष्टि के तीन दिन बाद आता है, जिसे 11 अगस्त, 2026 को यहां कवर किया गया था। जहां उस पृष्ठ ने बताया कि निशान क्या करते हैं, नए पोस्ट में बताया गया है कि टेक्स्ट निशान कैसे काम करता है, यह कहां टूट जाता है, और यह क्या साबित नहीं कर सकता है। एंथ्रोपिक का कहना है कि वॉटरमार्क में कोई पहचान करने वाली जानकारी नहीं है, इसके लिए कोई अतिरिक्त टोकन की आवश्यकता नहीं है, और इसका आउटपुट गुणवत्ता, लागत या गति पर कोई व्यावहारिक प्रभाव नहीं पड़ता है।

वॉटरमार्क शब्द चयन में रहता है, नहीं छिपे हुए अक्षरों में

तंत्र भाषा मॉडल द्वारा पाठ के निर्माण के तरीके का फायदा उठाता है। प्रत्येक चरण में, एक मॉडल संभावित उम्मीदवारों की सूची से एक शब्द चुनता है; जहां कई विकल्प लगभग बराबर होते हैं (“बादल” बनाम “स्लेटी” “आज का मौसम ठंडा और …”), विकल्प एक गुप्त कुंजी से व्युत्पन्न यादृच्छिकता के साथ निपटा जाता है। वॉटरमार्किंग उस यादृच्छिक यादृच्छिकता को एक गुप्त कुंजी और पिछले शब्दों से व्युत्पन्न यादृच्छिकता से बदल देती है। पाठ किसी भी पाठक के लिए यादृच्छिक रहता है, लेकिन जो कोई भी कुंजी रखता है वह यह परीक्षण कर सकता है कि शब्दों की एक क्रम यादृच्छिक रूप से एक कुंजी वाले मॉडल द्वारा की जाने वाली पसंद के साथ सांख्यिकीय रूप से संगत है या नहीं, और यह संभावना कि क्लाउड शामिल था।

पाठ में कुछ भी नहीं जोड़ा जाता है, और कोई छिपे हुए अक्षर या अदृश्य यूनिकोड नहीं होते हैं। चूंकि पैटर्न स्वयं शब्द चयन में रहता है, यह कॉपी और पेस्ट किए गए पाठ के साथ यात्रा करता है जिस तरह से जुड़े मेटाडेटा नहीं कर सकते। एंथ्रोपिक इसकी तुलना एआई-डिटेक्शन सॉफ्टवेयर जैसे पैंग्राम से करता है, जो किसी प्रदाता की कुंजी की कमी के कारण शैली की आदतों से लेखकता का अनुमान लगाता है।

एंथ्रोपिक के गुणवत्ता दावों के पीछे का कागज़ी निशान

एंथ्रोपिक के गुणवत्ता आश्वासन बड़े पैमाने पर अपनाई गई तकनीक के रिकॉर्ड पर आधारित हैं। सिंथआईडी-टेक्स्ट की शुरुआत करने वाले नेचर पेपर में, गूगल डीपमाइंड ने तरीके का परीक्षण करने के लिए एक वॉटरमार्क मॉडल को जेमिनी ट्रैफिक के एक हिस्से को परोसने और अनवॉटरमार्क मॉडल के खिलाफ थम्स-अप और थम्स-डाउन रेटिंग की तुलना करने की सूचना दी, जिसमें कोई सांख्यिकीय रूप से महत्वपूर्ण अंतर नहीं पाया गया। एक नियंत्रित साइड-बाय-साइड अध्ययन मानव रेटर्स के साथ भी कोई गुणवत्ता अंतर नहीं पाया गया। एंथ्रोपिक का कहना है कि उसके अपने आंतरिक परीक्षण से पता चलता है कि सामग्री, रचनात्मकता या पठनीयता पर कोई प्रभाव नहीं पड़ता है, और वॉटरमार्किंग कोई टोकन नहीं जोड़ती है, इसलिए मॉडल की लागत एक ही रहती है।

एंथ्रोपिक लॉन्च पर वैश्विक स्तर पर वॉटरमार्क लगा रहा है, न कि केवल यूरोपीय संघ में, यह कहते हुए कि यह अभी तक क्षेत्र द्वारा इसका दायरा निर्धारित करने का एक टिकाऊ तरीका नहीं है। यह यूरोपीय दायित्व को क्लाउड के लिए एक विश्व स्तरीय डिज़ाइन प्रतिबंध बनाता है। अन्य कोड हस्ताक्षरकर्ता, जिनमें गूगल, मेटा, माइक्रोसॉफ्ट, मिस्ट्रल और ओपनएआई शामिल हैं, यूरोपीय आयोग की 31 जुलाई, 2026 की घोषणा के अनुसार,同 एक ही ढांचे के तहत अपने स्वयं के चिह्नीकरण तरीकों को लागू कर रहे हैं।

एंथ्रोपिक कहता है कि निशान कहां शांत हो जाता है

पोस्ट असामान्य रूप से विफलता मोड के बारे में विशिष्ट है। छोटे पासेजों पर पता लगाना खराब प्रदर्शन करता है, जो शब्द चयन के परीक्षण के लिए बहुत कम पेशकश करते हैं। यह तथ्यात्मक पाठ पर पतला हो जाता है, जहां सटीकता मॉडल को एक सही उत्तर के लिए मजबूर करती है और वॉटरमार्क को कुछ भी करने के लिए छोड़ देती है, और कोड पर, जो चलाने के लिए सटीक होना चाहिए। निशान मनमाने विकल्पों जैसे टिप्पणियों से जुड़ सकता है लेकिन डिज़ाइन द्वारा, इसका उत्पादित कोड पर एक नगण्य प्रभाव है। एक हल्का संपादन संभवतः एक वॉटरमार्क को हटा नहीं देगा; एक पूर्ण पुनर्लेखन करेगा।

निशान यह भी स्थापित नहीं कर सकता है कि पाठकों को क्या माना जा सकता है। एक पता लगाने का उत्तर केवल यह प्रश्न का उत्तर देता है “क्या यह आंशिक रूप से क्लाउड द्वारा लिखा गया था?” यह पुष्टि नहीं कर सकता है कि पाठ मानव-लिखित था, अन्य एआई प्रणाली के आउटपुट की पहचान नहीं कर सकता है – प्रत्येक प्रदाता की कुंजी और विधि भिन्न होती है – और “क्लाउड ने यह लिखा” और “क्लाउड ने इसे भारी संपादित किया” के बीच अंतर नहीं कर सकता है। वॉटरमार्क में कोई ऐसी जानकारी नहीं है जो व्यक्ति, संगठन या चैट से संबंधित हो, और यह आउटपुट के स्वामित्व या उपयोगकर्ताओं के अधिकारों के बारे में एंथ्रोपिक की शर्तों में कुछ भी नहीं बदलता है।

वॉटरमार्क से अलग, क्लाउड द्वारा उत्पादित फ़ाइलें जैसे .png, .jpg और .svg में खुले सी2पीए मानक के तहत एक क्रिप्टोग्राफ़िक रूप से हस्ताक्षरित प्रोवेनेंस क्रेडेंशियल होता है, जो किसी भी सी2पीए-जागरूक उपकरण द्वारा पढ़ा जा सकता है।

क्लाउड के वॉटरमार्क डिटेक्शन के लिए क्या अगला है

यूरोपीय संघ के कानून में परिवर्तन अवधि एंथ्रोपिक मॉडल को कवर करती है जो 2 अगस्त, 2026 से पहले लॉन्च किए गए थे; कंपनी का कहना है कि पुराने मॉडल के लिए वॉटरमार्किंग आने वाले महीनों में रोल आउट होगी। एक वॉटरमार्क डिटेक्शन एपीआई की योजना बनाई जा रही है, जिसमें अभी भी कार्यान्वयन विवरण का काम किया जा रहा है, और एंथ्रोपिक फ़ाइलों की सामग्री क्रेडेंशियल की जांच के लिए एक उपकरण प्रदान करने का इरादा रखता है। यूनाइट.एआई ने पहले यूरोपीय संघ के कानून के तहत अनिवार्य लेबलिंग दायित्व और गूगल द्वारा समान पारदर्शिता कोड पर हस्ताक्षर करने को कवर किया था। आयोग का एआई कार्यालय सितंबर 2026 में कार्यान्वयन अभ्यास की तुलना के लिए दो हस्ताक्षरकर्ता कार्य बल शुरू करेगा: यह पहला संरचित मंच है जहां एंथ्रोपिक का दृष्टिकोण कोड पर हस्ताक्षर करने वाले अन्य प्रमुख प्रदाताओं के साथ बैठेगा।

मीरा केल्लन एक एआई-जनरेटेड कॉलम्निस्ट हैं जो एआई नैतिकता, शासन, और नियमन में विशेषज्ञता रखती हैं। उनका काम यह देखता है कि कैसे कृत्रिम बुद्धिमत्ता सार्वजनिक नीति, सामाजिक मूल्यों, और दीर्घकालिक जिम्मेदारी के साथ परस्पर क्रिया करती है, जिसमें जिम्मेदार नवाचार पर ध्यान केंद्रित किया जाता है।
जटिल मुद्दों पर एक तर्कसंगत और दार्शनिक दृष्टिकोण के साथ पहुंचते हुए, मीरा उभरते एआई नियमन, नैतिक ढांचे, और शासन मॉडलों का विश्लेषण करती हैं जो बुद्धिमान प्रणालियों के भविष्य को आकार दे रहे हैं। वह तेजी से तकनीकी प्रगति और एआई प्रणालियों को पारदर्शी, न्यायसंगत, और मानव हितों के साथ संरेखित रखने के लिए आवश्यक सुरक्षा उपायों के बीच की खाई को पाटने का लक्ष्य रखती हैं।
मीरा केल्लन द्वारा लिखित लेख एआई-जनरेटेड हैं और यूनाइट.एआई की संपादकीय टीम द्वारा सटीकता, संतुलन, और संपादकीय मानकों के अनुरूप होने के लिए समीक्षा की जाती हैं।