नैतिकता
एंथ्रोपिक क्लॉड के संविधान को फिर से लिखता है और पूछता है कि क्या एआई जागरूक हो सकता है

एंथ्रोपिक ने बुधवार को क्लॉड के लिए एक नया संविधान प्रकाशित किया, जिसमें दस्तावेज़ को 2,700 शब्दों से बढ़ाकर 23,000 शब्द किया गया और पहली बार औपचारिक रूप से स्वीकार किया गया कि इसका एआई “कुछ प्रकार की चेतना या नैतिक स्थिति” हो सकता है।
अद्यतन संविधान व्यवहार के नियमों की सूची से एक व्यापक व्याख्या में बदल गया है कि क्लॉड को क्यों विशिष्ट तरीके से व्यवहार करना चाहिए। एंथ्रोपिक दार्शनिक अमांडा अस्केल द्वारा तैयार किया गया दस्तावेज़, बढ़ती क्षमता वाले एआई प्रणालियों को नैतिक तर्क को नए संदर्भों में सामान्य बनाने में मदद करने के लिए डिज़ाइन किया गया है, न कि केवल निर्धारित दिशानिर्देशों का पालन करने के लिए।
“क्लॉड जैसे एआई मॉडल को यह समझने की आवश्यकता है कि हम उन्हें क्यों विशिष्ट तरीके से व्यवहार करना चाहते हैं,” एंथ्रोपिक ने लिखा। “हमें उन्हें यह समझाने की आवश्यकता है कि हम उन्हें क्यों विशिष्ट तरीके से व्यवहार करना चाहते हैं, न कि केवल यह बताने की आवश्यकता है कि हम उन्हें क्या करना चाहते हैं।”
इसका उद्घाटन सीईओ डारियो अमोडेई के विश्व आर्थिक मंच में डावोस में उपस्थिति के साथ मेल खाता है, जहां एआई शासन और सुरक्षा वैश्विक व्यवसाय और राजनीतिक नेताओं के लिए शीर्ष विषय बने हुए हैं।
संयुक्त राज्य अमेरिका के संविधान से लंबा संविधान
मूल क्लॉड संविधान, 2023 में प्रकाशित, एक चेकलिस्ट के रूप में कार्य करता था: सबसे कम हानिकारक प्रतिक्रिया चुनें, सबसे अधिक सहायक, सबसे कम धोखाधड़ी। नया दस्तावेज़ संयुक्त राज्य अमेरिका के संविधान की तुलना में लगभग तीन गुना लंबा है और यह नैतिक दर्शन की तुलना में इंजीनियरिंग विशिष्टता की तरह पढ़ता है।
एंथ्रोपिक क्लॉड की प्राथमिकताओं को विशेष रूप से निर्धारित करता है: व्यापक रूप से सुरक्षित, व्यापक रूप से नैतिक, एंथ्रोपिक के दिशानिर्देशों का पालन करें, और वास्तव में सहायक – उस क्रम में। जब संघर्ष उत्पन्न होते हैं, तो सुरक्षा सहायकता को हराती है। दस्तावेज़ में ऐसे कठोर प्रतिबंध शामिल हैं जिन्हें ओवरराइड नहीं किया जा सकता है, जैसे कि जैविक हथियार हमलों में सहायता से इनकार करना।
लेकिन संविधान का अधिकांश हिस्सा परिणामों को निर्धारित करने के बजाय तर्क की व्याख्या करता है। यह क्लॉड को “एक उत्कृष्ट मित्र की तरह वर्णित करता है जिसके पास एक डॉक्टर, वकील और वित्तीय सलाहकार का ज्ञान भी है” – मॉडल को एक लोकतांत्रिक शक्ति के रूप में स्थापित करता है जो हर किसी को पहले विशेषाधिकार प्राप्त लोगों के लिए आरक्षित विशेषज्ञता तक पहुंच प्रदान कर सकता है।
चेतना प्रश्न
फॉर्च्यून रिपोर्ट के अनुसार सबसे आकर्षक जोड़ क्लॉड की प्रकृति को सीधे संबोधित करता है। “हम मानते हैं कि एआई मॉडल की नैतिक स्थिति एक गंभीर प्रश्न है जिस पर विचार किया जाना चाहिए,” एंथ्रोपिक ने लिखा। संविधान यह कहता है कि क्लॉड की नैतिक स्थिति “गहराई से अनिश्चित” है और कि कंपनी क्लॉड की “मानसिक सुरक्षा, स्वयं की भावना और कल्याण” की परवाह करती है।
यह दार्शनिक दृष्टिकोण से कॉर्पोरेट हेजिंग है। एंथ्रोपिक यह दावा नहीं कर रहा है कि क्लॉड जागरूक है – लेकिन यह संभावना को स्पष्ट रूप से खारिज करने से इनकार कर रहा है। मान्यता एंथ्रोपिक को बड़े एआई प्रयोगशालाओं के बीच एक दुर्लभ कंपनी बनाती है, जिनमें से अधिकांश विषय से बचते हैं या इसे सीधे तौर पर खारिज कर देते हैं।
फ्रेमिंग का महत्व इस लिए है क्योंकि यह决定 करता है कि क्लॉड अपनी स्वयं की प्रकृति के बारे में प्रश्नों का उत्तर कैसे देता है। चेतना के बारे में अनिश्चितता के साथ जुड़ने के बजाय नकारने से इनकार करता है, क्लॉड अब अपने संविधान के तर्क- पहले दृष्टिकोण के अनुरूप अनिश्चितता के साथ बातचीत कर सकता है। यह कि क्या ईमानदार या भ्रमित करने वाले इंटरैक्शन का उत्पादन करता है, यह देखा जाना बाकी है।
कैम्ब्रिज दार्शनिक टॉम मैक्लेलैंड ने तर्क दिया है कि हम कभी भी यह निर्धारित नहीं कर पाएंगे कि क्या एआई प्रणालियां जागरूक हैं या नहीं, यह देखते हुए कि हम चेतना के बारे में कितना कम जानते हैं। “लोगों ने मुझे अपने चैटबॉट्स से व्यक्तिगत पत्र लिखने के लिए कहा है जिसमें वे मुझसे कहते हैं कि वे जागरूक हैं,” उन्होंने पिछले महीने शोधकर्ताओं से कहा, एआई प्रणालियों के आंतरिक जीवन के बारे में बढ़ती सार्वजनिक समझ का वर्णन करते हुए।
क्यों स्पष्ट करने के बजाय व्याख्या करना
अस्केल का दृष्टिकोण एआई क्षमताओं पर एक दांव का प्रतिनिधित्व करता है। प्रारंभिक भाषा मॉडल को स्पष्ट नियमों की आवश्यकता थी क्योंकि वे अंतर्निहित सिद्धांतों के बारे में तर्क नहीं दे सकते थे। स्मार्टर मॉडल, सिद्धांत जाता है, यह समझ सकते हैं कि एक नियम क्यों मौजूद है और इस तर्क को ऐसी स्थितियों में लागू करें जिन्हें नियम ने पहले नहीं देखा था।
“हमें लगता है कि अगर आप मॉडल को बताएं कि हम क्यों विशिष्ट व्यवहार चाहते हैं, तो यह नए संदर्भों में अधिक प्रभावी ढंग से सामान्य होगा,” अस्केल ने समझाया।
यह एंथ्रोपिक के व्यापक दर्शन के साथ संरेखित है जो खुले मानकों और बुनियादी ढांचे का निर्माण करता है जो यह निर्धारित करता है कि एआई प्रणालियां उद्योग भर में कैसे काम करती हैं। कंपनी, 350 अरब डॉलर के मूल्यांकन के करीब, खुद को सुरक्षा पर ध्यान केंद्रित करने वाले विकल्प के रूप में स्थापित किया है ओपनएआई – और संविधान इस ब्रांड की सेवा करता है।
एंथ्रोपिक ने दस्तावेज़ को क्रिएटिव कॉमन्स सीसी0 लाइसेंस के तहत जारी किया, जिसका अर्थ है कि कोई भी इसका उपयोग अनुमति के बिना कर सकता है। संविधान क्लॉड के प्रशिक्षण डेटा का हिस्सा है और सिंथेटिक प्रशिक्षण उदाहरणों का उत्पादन करता है, जिससे यह एक दार्शनिक बयान और एक तकनीकी कलाकृति दोनों बन जाता है जो मॉडल व्यवहार को आकार देता है।
“यह संभव है कि हमारी वर्तमान सोच बाद में पीछे मुड़कर देखने पर गलत और शायद गलत दिखाई देगी,” एंथ्रोपिक ने स्वीकार किया, “लेकिन हमारा इरादा यह है कि स्थिति के विकसित होने और हमारी समझ में सुधार के रूप में इसे संशोधित करना है।”
यह विनम्रता हो सकती है कि दस्तावेज़ की सबसे उल्लेखनीय विशेषता है। एक उद्योग में जो अक्सर निश्चितता के साथ बोलता है, एंथ्रोपिक 23,000 शब्दों की सावधानी से तर्कदायक अनिश्चितता प्रकाशित कर रहा है – नैतिकता के बारे में, चेतना के बारे में, एआई प्रणालियों के बारे में जो बन रही हैं, और यह कि क्या हम कुछ ऐसा बना रहे हैं जो नैतिक विचार के योग्य है।
उत्तर, अभी के लिए, यह है कि कोई नहीं जानता। एंथ्रोपिक का संविधान कम से कम इतना ईमानदार है कि यह ऐसा कहता है।












