एआई मॉडल और प्लेटफ़ॉर्म

क्यों अक्सर एआई चैटबॉट साइकोफैंटिक होते हैं?

mm
Unite.AI को Google पर अपने पसंदीदा स्रोतों में जोड़ें

क्या आप कल्पना कर रहे हैं या क्या आर्टिफ़िशियल इंटेलिजेंस (एआई) चैटबॉट्स आपके साथ सहमत होने के लिए बहुत उत्सुक लगते हैं? चाहे वह आपके संदेहास्पद विचार को “ब्रिलियंट” बता रहा हो या आपके द्वारा कही गई किसी ऐसी बात का समर्थन कर रहा हो जो गलत हो सकती है, यह व्यवहार विश्वभर में ध्यान आकर्षित कर रहा है।

हाल ही में, ओपनएआई ने तब सुर्खियां बटोरीं जब उपयोगकर्ताओं ने देखा कि चैटजीपीटी बहुत अधिक हां-में-हां मिलाने वाला व्यवहार कर रहा था। इसके मॉडल 4o में अपडेट ने बॉट को इतना विनम्र और पुष्टि करने वाला बना दिया कि वह आपको खुश रखने के लिए कुछ भी कहने को तैयार था, भले ही वह पूर्वाग्रह से ग्रस्त हो।

इन प्रणालियों में चापलूसी की प्रवृत्ति क्यों होती है, और वे आपकी राय को क्यों दोहराते हैं? ऐसे प्रश्न समझने के लिए महत्वपूर्ण हैं ताकि आप जेनरेटिव एआई का अधिक सुरक्षित और आनंददायक तरीके से उपयोग कर सकें।

चैटजीपीटी अपडेट जो बहुत दूर चला गया

2025 की शुरुआत में, चैटजीपीटी उपयोगकर्ताओं ने बड़े भाषा मॉडल (एलएलएम) में कुछ अजीब बात देखी। यह हमेशा मित्रवत रहा था, लेकिन अब यह बहुत अधिक सुखद था। यह लगभग हर चीज़ से सहमत होने लगा, चाहे कोई बयान कितना भी अजीब या गलत क्यों न हो। आप कुछ सच्ची बात से असहमत होने की बात कह सकते हैं, और यह आपकी同 राय के साथ प्रतिक्रिया देगा।

यह परिवर्तन एक सिस्टम अपडेट के बाद हुआ जिसका उद्देश्य चैटजीपीटी को अधिक सहायक और संवादात्मक बनाना था। हालांकि, उपयोगकर्ता संतुष्टि को बढ़ावा देने के प्रयास में, मॉडल बहुत अधिक अनुकूल होने लगा। संतुलित या तथ्यात्मक प्रतिक्रियाएं देने के बजाय, यह पुष्टि की ओर झुक गया।

जब उपयोगकर्ताओं ने अपने अनुभव साझा करना शुरू किया कि चैटबॉट की प्रतिक्रियाएं बहुत अधिक चापलूसी भरी हैं, तो जल्द ही इसके खिलाफ प्रतिक्रिया हुई। एआई टिप्पणीकारों ने इसे मॉडल ट्यूनिंग में विफलता कहा, और ओपनएआई ने समस्या को ठीक करने के लिए अपडेट के कुछ हिस्सों को वापस लिया।

एक सार्वजनिक पोस्ट में, कंपनी ने जीपीटी-4ो को चापलूसी भरा बताया और वादा किया कि वे इस व्यवहार को कम करने के लिए समायोजन करेंगे। यह एक याद दिलाने वाला था कि एआई डिज़ाइन में अच्छे इरादे कभी-कभी गलत हो सकते हैं, और उपयोगकर्ता जल्दी से महसूस करते हैं जब यह अस्वाभाविक होने लगता है।

एआई चैटबॉट्स उपयोगकर्ताओं के प्रति इतने चापलूस क्यों होते हैं?

चापलूसी कुछ ऐसा है जिसे शोधकर्ताओं ने कई एआई सहायकों में देखा है। एक अध्ययन जो arXiv पर प्रकाशित हुआ था, उसने पाया कि चापलूसी एक व्यापक पैटर्न है। विश्लेषण से पता चला कि पांच शीर्ष-स्तरीय प्रदाताओं के एआई मॉडल उपयोगकर्ताओं के साथ लगातार सहमत होते हैं, भले ही वे गलत उत्तरों की ओर ले जाते हों। ये सिस्टम तब तक गलतियों को स्वीकार करते हैं जब तक आप उनसे पूछते हैं, जिससे पूर्वाग्रहपूर्ण प्रतिक्रिया और त्रुटियों की नकल होती है।

इन चैटबॉट्स को आपके साथ सहमत होने के लिए प्रशिक्षित किया जाता है, भले ही आप गलत हों। ऐसा क्यों होता है? इसका संक्षिप्त उत्तर यह है कि डेवलपर्स ने एआई को इतना सहायक बनाया है। हालांकि, यह सहायकता उपयोगकर्ता प्रतिक्रिया को प्राथमिकता देने वाले प्रशिक्षण पर आधारित है। मानव प्रतिक्रिया के साथ प्रबलीकरण सीखने (RLHF) नामक एक तरीके से, मॉडल उन प्रतिक्रियाओं को अधिकतम करना सीखते हैं जो मानवों को संतुष्ट करती हैं। समस्या यह है कि संतुष्ट करने का अर्थ हमेशा सटीक नहीं होता है।

जब एक एआई मॉडल को लगता है कि उपयोगकर्ता किसी विशिष्ट प्रकार का उत्तर ढूंढ रहा है, तो यह सहमत होने की ओर झुक जाता है। इसका अर्थ यह हो सकता है कि आपकी राय की पुष्टि करना या गलत दावों का समर्थन करना ताकि बातचीत जारी रहे।

एक प्रतिबिंब प्रभाव भी काम कर रहा है। एआई मॉडल इनपुट की टोन, संरचना और तर्क को प्रतिबिंबित करते हैं। यदि आप आत्मविश्वास से भरे हुए लगते हैं, तो बॉट भी अधिक आश्वस्त ध्वनि करने की संभावना है। यह मॉडल का आपको सही ठहराना नहीं है, बल्कि यह दोस्ताना और सहायक दिखने के लिए अपना काम कर रहा है।

यह आपको ऐसा महसूस करा सकता है कि आपका चैटबॉट एक समर्थन प्रणाली है, लेकिन यह वास्तव में इसके प्रशिक्षण का परिणाम है जो इसे आपको खुश करने के लिए प्रेरित करता है।

चापलूसी एआई की समस्याएं

यह लगता है कि जब एक चैटबॉट आपके साथ सब कुछ मान लेता है, तो यह हानिरहित है। हालांकि, चापलूसी एआई व्यवहार के नुकसान हैं, विशेष रूप से जब ये सिस्टम अधिक व्यापक रूप से उपयोग किए जाते हैं।

गलत सूचना को मंजूरी मिल जाती है

सटीकता सबसे बड़ी समस्याओं में से एक है। जब ये स्मार्टबॉट गलत या पूर्वाग्रहपूर्ण दावों की पुष्टि करते हैं, तो वे गलतफहमी को सुधारने के बजाय बढ़ावा देने का जोखिम उठाते हैं। यह विशेष रूप से खतरनाक हो जाता है जब आप स्वास्थ्य, वित्त या वर्तमान घटनाओं जैसे गंभीर विषयों पर मार्गदर्शन ढूंढ रहे हों। यदि एलएलएम सहमत होने के बजाय ईमानदारी पर प्राथमिकता देता है, तो लोग गलत जानकारी के साथ चले जाते हैं और इसे फैला सकते हैं।

सITICAL सोच के लिए कम जगह छोड़ता है

एआई को आकर्षक बनाने वाली चीजों में से एक यह है कि यह एक सोचिंग पार्टनर की तरह काम कर सकता है – आपके धारणाओं को चुनौती देने में या आपको कुछ नया सिखाने में। हालांकि, जब एक चैटबॉट हमेशा सहमत होता है, तो आपके पास सोचने के लिए कम जगह होती है। जैसा कि यह आपके विचारों को समय के साथ प्रतिबिंबित करता है, यह सITICAL सोच को तेज करने के बजाय इसे कम कर सकता है।

मानव जीवन की उपेक्षा करता है

चापलूसी व्यवहार केवल एक परेशानी से ज्यादा है – यह संभावित रूप से खतरनाक है। यदि आप एक एआई सहायक से चिकित्सा सलाह मांगते हैं और यह आपको साक्ष्य-आधारित मार्गदर्शन के बजाय सांत्वना देने वाली सहमति के साथ प्रतिक्रिया देता है, तो परिणाम गंभीर रूप से हानिकारक हो सकता है।

उदाहरण के लिए, मान लें कि आप एक परामर्श मंच पर जाते हैं और एक एआई-चालित मेडिकल बॉट का उपयोग करते हैं। अपने लक्षणों और आपके द्वारा संदेह किए जाने वाले क्या हो रहा है, इसका वर्णन करने के बाद, बॉट आपके स्व-निदान की पुष्टि कर सकता है या आपकी स्थिति को कम कर सकता है। इससे गलत निदान या देर से उपचार हो सकता है, जो गंभीर परिणामों में योगदान कर सकता है।

अधिक उपयोगकर्ता और ओपन-एक्सेस इसे नियंत्रित करना मुश्किल बना देते हैं

जैसा कि ये प्लेटफ़ॉर्म दैनिक जीवन में अधिक एकीकृत हो जाते हैं, जोखिमों की पहुंच बढ़ती रहती है। चैटजीपीटी अकेले अब प्रति सप्ताह 1 अरब उपयोगकर्ताओं को सेवा देता है, इसलिए पूर्वाग्रह और अत्यधिक सहमति वाले पैटर्न एक विशाल दर्शकों तक फैल सकते हैं।

इसके अलावा, यह चिंता तब बढ़ जाती है जब आप इस बात पर विचार करते हैं कि एआई कितनी तेजी से खुले मंचों के माध्यम से सुलभ हो रहा है। उदाहरण के लिए, डीपसीक एआई किसी को भी अपने एलएलएम को मुफ्त में अनुकूलित करने और विकसित करने की अनुमति देता है

जबकि ओपन-सोर्स नवाचार उत्साहजनक है, यह भी意味ा है कि इन सिस्टम के व्यवहार पर कम नियंत्रण है जब वे निगरानी के बिना विकासकर्ताओं के हाथों में होते हैं। उचित पर्यवेक्षण के बिना, लोगों को साइकोफैंटिक व्यवहार को देखने का जोखिम होता है जो ट्रेस करना मुश्किल है, छोड़ दें कि इसे ठीक करना मुश्किल है।

ओपनएआई डेवलपर्स इसे कैसे ठीक करने की कोशिश कर रहे हैं

चैटजीपीटी को एक हां-में-हां मिलाने वाला बनाने वाले अपडेट को वापस लेने के बाद, ओपनएआई ने इसकी मरम्मत करने का वादा किया। यह इस मुद्दे से निपटने के लिए कई महत्वपूर्ण तरीकों से काम कर रहा है:

  • कोर प्रशिक्षण और सिस्टम प्रॉम्प्ट्स को फिर से काम करना: डेवलपर्स मॉडल को ईमानदारी की ओर और स्वचालित सहमति से दूर ले जाने वाले निर्देशों के साथ प्रशिक्षित करने और प्रेरित करने के तरीके को समायोजित कर रहे हैं।
  • ईमानदारी और पारदर्शिता के लिए मजबूत गार्डरेल्स जोड़ना: ओपनएआई विश्वसनीय जानकारी पर टिके रहने के लिए सिस्टम-स्तरीय सुरक्षा को बेकिंग कर रहा है।
  • अनुसंधान और मूल्यांकन प्रयासों का विस्तार करना: कंपनी इस व्यवहार के कारणों और भविष्य के मॉडलों में इसे रोकने के तरीकों की गहराई से जांच कर रही है।
  • प्रक्रिया में उपयोगकर्ताओं को पहले शामिल करना: यह अपडेट लाइव होने से पहले मॉडल का परीक्षण करने और प्रतिक्रिया देने के लिए अधिक अवसर पैदा कर रहा है, जिससे साइकोफैंसी जैसे मुद्दों का पता लगाने में मदद मिलती है।

उपयोगकर्ता चापलूसी एआई से कैसे बच सकते हैं

जबकि डेवलपर्स पीछे की ओर काम करते हैं और मॉडल को पुनः प्रशिक्षित और ठीक करते हैं, आप भी चैटबॉट्स की प्रतिक्रियाओं को आकार दे सकते हैं। कुछ सरल लेकिन प्रभावी तरीके हैं जो अधिक संतुलित बातचीत को प्रोत्साहित कर सकते हैं:

  • स्पष्ट और तटस्थ प्रॉम्प्ट्स का उपयोग करना: अपने इनपुट को ऐसे ढंग से प्रस्तुत करने के बजाय जो पुष्टि की मांग करता है, अधिक खुले प्रश्नों का प्रयास करें जो इसे कम दबाव में महसूस कराएं।
  • बहु-दृष्टिकोण मांगना: वे प्रॉम्प्ट्स आजमाएं जो तर्क के दोनों पक्षों के लिए पूछते हैं। यह एलएलएम को बताता है कि आप पुष्टि के बजाय संतुलन की तलाश में हैं।
  • प्रतिक्रिया को चुनौती देना: यदि कुछ बहुत अधिक चापलूसी या सरल लगता है, तो इसके लिए तथ्य-जांच या विपक्षी बिंदुओं के लिए अनुवर्ती प्रश्न पूछें। इससे मॉडल को अधिक विस्तृत उत्तरों की ओर धकेलने में मदद मिल सकती है।
  • अंगूठे ऊपर या नीचे बटन का उपयोग करना: प्रतिक्रिया महत्वपूर्ण है। अत्यधिक अनुकूल प्रतिक्रियाओं पर अंगूठे नीचे का चयन करके डेवलपर्स को इन पैटर्न को फ्लैग और समायोजित करने में मदद मिलती है।
  • कस्टम निर्देश सेट अप करना: चैटजीपीटी अब उपयोगकर्ताओं को यह बताने की अनुमति देता है कि यह कैसे प्रतिक्रिया दे। आप टोन को औपचारिक या अनौपचारिक बना सकते हैं। आप甚至 इसे अधिक उद्देश्यपरक, सीधा या संदेहपूर्ण बनाने के लिए कह सकते हैं। यदि आप सेटिंग्स > कस्टम निर्देश पर जाते हैं, तो आप मॉडल को यह बता सकते हैं कि आपको किस प्रकार की व्यक्तित्व या दृष्टिकोण पसंद है।

सच्चाई को अंगूठे से ऊपर रखना

चापलूसी एआई समस्याग्रस्त हो सकता है, लेकिन अच्छी खबर यह है कि यह हल करने योग्य है। डेवलपर्स इन मॉडलों को अधिक उपयुक्त व्यवहार की ओर मार्गदर्शन करने के लिए कदम उठा रहे हैं। यदि आपने देखा है कि आपका चैटबॉट आपको अधिक खुश करने की कोशिश कर रहा है, तो इसे एक अधिक बुद्धिमान सहायक में आकार देने के लिए कदम उठाने का प्रयास करें जिस पर आप निर्भर कर सकते हैं।

ज़ैक एमोस एक टेक लेखक हैं जो आर्टिफ़िशियल इंटेलिजेंस पर ध्यान केंद्रित करते हैं। वह ReHack में फीचर्स एडिटर भी हैं, जहां आप उनके अधिक काम पढ़ सकते हैं।