विचार नेता
एआई-पहला सुरक्षा-पहला का अर्थ

एक बच्चे को एक नई साइकिल खरीदने के लिए, और साइकिल सभी ध्यान आकर्षित करेगी – न ही चमकदार हेलमेट जो इसके साथ आता है। लेकिन माता-पिता हेलमेट की सराहना करते हैं।
मुझे लगता है कि हममें से अधिकांश आज एआई के संबंध में बच्चों की तरह हैं। हम इसकी गति और इसके साथ कितनी तेजी से जा सकते हैं, इस पर ध्यान केंद्रित कर रहे हैं। इसका उपयोग करते समय सुरक्षित रहने के लिए हम क्या कर सकते हैं, इस पर नहीं। यह दुर्भाग्यपूर्ण है क्योंकि आप एक का लाभ नहीं उठा सकते हैं बिना दूसरे के।
साधारण शब्दों में, सुरक्षा की योजना बनाए बिना एआई लागू करना जोखिम भरा नहीं है। यह एक सीधा मार्ग है जो एक पहाड़ी से गिरने की ओर जाता है।
एआई सुरक्षा का अर्थ क्या है?
एआई सुरक्षा में कई चरण शामिल हैं। लेकिन शायद सबसे महत्वपूर्ण तत्व यह है कि कब उन्हें लेना है। प्रभावी होने के लिए, एआई सुरक्षा को डिज़ाइन द्वारा होना चाहिए।
इसका अर्थ है कि हमें पहले से ही यह सोचना होगा कि हम कैसे नुकसान से बच सकते हैं। हमें यह सुनिश्चित करना होगा कि एआई हमारे मूल्यों और सामाजिक अपेक्षाओं के अनुसार परिणाम उत्पन्न करे और संचालित हो, न कि हमें भयानक परिणाम मिलने के बाद।
एआई सुरक्षा के लिए डिज़ाइन करना भी इसमें शामिल है कि हम इसे मजबूत, या खराब परिस्थितियों में भी सटीक रूप से कैसे काम कर सकते हैं। इसका अर्थ है एआई को पारदर्शी बनाना, ताकि एआई द्वारा लिए गए निर्णय समझने योग्य, लेखा परीक्षित और पूर्वाग्रह से मुक्त हों।
लेकिन इसमें यह भी शामिल है कि हम उस दुनिया को देखें जिसमें एआई कार्य करेगा। हमें किन संस्थागत और कानूनी सुरक्षा उपायों की आवश्यकता है, विशेष रूप से लागू सरकारी नियमों का पालन करने के लिए? और मैं लोगों के घटक पर जोर नहीं दे सकता : एआई के उपयोग का उन लोगों पर क्या प्रभाव पड़ेगा जो इसके साथ बातचीत करते हैं?
सुरक्षा डिज़ाइन का अर्थ है कि हम एआई सुरक्षा को अपनी सभी प्रक्रियाओं, कार्य प्रवाह और संचालन में पहले से ही शामिल करें trước कि हम अपना पहला प्रॉम्प्ट टाइप करें।
जोखिम चिंताओं से अधिक हैं
सभी सहमत नहीं हैं। जब वे “सुरक्षा-पहले” सुनते हैं, तो कुछ “इतनी सावधानी से और धीरे से कदम रखें कि आप पीछे छूट जाएं” सुनते हैं। बिल्कुल, यही सुरक्षा-पहले का अर्थ है। इसका अर्थ यह नहीं है कि नवाचार को दबाना होगा या समय-सीमा को धीमा करना होगा। और इसका अर्थ यह नहीं है कि ऐसे पायलटों की एक अंतहीन धारा है जो कभी भी स्केल नहीं करते हैं। इसके विपरीत।
इसका अर्थ है एआई में सुरक्षा को डिज़ाइन करने के जोखिमों को समझना। कुछ पर विचार करें।
- डेलॉइट के फाइनेंशियल सर्विसेज सेंटर का अनुमान है कि जेनएआई 2027 तक अमेरिका में अकेले 40 अरब डॉलर के फ्रॉड नुकसान के लिए जिम्मेदार हो सकता है, 2023 में 12.3 अरब डॉलर से 32% सीएजीआर।
- पूर्वाग्रहित निर्णय। मामले दस्तावेज पूर्वाग्रहित चिकित्सा देखभाल एआई के कारण जो पूर्वाग्रहित डेटा पर प्रशिक्षित किया गया था।
- बुरे निर्णय जो और बुरे निर्णय को प्रेरित करते हैं। एआई द्वारा उत्प्रेरित एक प्रारंभिक बुरा निर्णय से भी बदतर, अध्ययनों से पता चलता है कि वे दोषपूर्ण निर्णय भविष्य के निर्णय लेने के तरीके का हिस्सा बन सकते हैं।
- वास्तविक परिणाम. खराब चिकित्सा सलाह देने वाला एआई घातक रोगी परिणामों के लिए जिम्मेदार रहा है। कानूनी मुद्दे एआई के भ्रम को कानूनी पूर्वगामी के रूप में उद्धृत करने से उत्पन्न हुए हैं। और एआई सहायक द्वारा गलत जानकारी देने से सॉफ्टवेयर त्रुटियां उत्पन्न हुई हैं जो कंपनी के उत्पादों और प्रतिष्ठा को दूषित कर देती हैं और व्यापक उपयोगकर्ता असंतुष्टता का कारण बनती हैं।
और चीजें और भी दिलचस्प होने वाली हैं।
स्वायत्त रूप से कार्य करने और निर्णय लेने के आधार पर कार्रवाई करने में सक्षम एआई, एआई एजेंटों की शुरुआत और तेजी से गोद लेने से एआई सुरक्षा के लिए डिज़ाइन करने का महत्व और भी बढ़ जाएगा।
एक एआई एजेंट जो आपकी ओर से कार्य कर सकता है, बहुत उपयोगी हो सकता है। इसके बजाय आपको यात्रा के लिए सबसे अच्छी उड़ानों के बारे में बताने के, यह उन्हें आपके लिए ढूंढ सकता है और बुक कर सकता है। यदि आप एक उत्पाद वापस करना चाहते हैं, तो कंपनी का एआई एजेंट न केवल रिटर्न नीति और रिटर्न दाखिल करने के तरीके के बारे में बता सकता है, बल्कि पूरे लेन-देन को भी संभाल सकता है।
शानदार – जब तक कि एजेंट को कोई उड़ान का भ्रम न हो या आपकी वित्तीय जानकारी को गलत न करे या कंपनी की रिटर्न नीति को गलत न बताए और वैध रिटर्न को अस्वीकार न करे।
यह देखना मुश्किल नहीं है कि वर्तमान एआई सुरक्षा जोखिम कैसे आसानी से एआई एजेंटों के एक समूह के साथ बढ़ सकते हैं जो निर्णय ले रहे हैं और कार्य कर रहे हैं, खासकर जब वे अकेले कार्य नहीं करेंगे। एआई एजेंटों का अधिकांश वास्तविक मूल्य तब आएगा जब वे टीमों में काम करेंगे, जहां व्यक्तिगत एजेंट कार्यों के हिस्सों को संभालेंगे और कार्य पूरा करने के लिए एजेंट से एजेंट के साथ सहयोग करेंगे।
तो आप नवाचार को दबाने और इसके संभावित मूल्य को मारने के बिना एआई सुरक्षा द्वारा डिज़ाइन को कैसे अपना सकते हैं?
सुरक्षा डिज़ाइन कार्रवाई में
अधो-सरंचना सुरक्षा जांच का उत्तर नहीं है। लेकिन एआई कार्यान्वयन के हर चरण में सुरक्षा प्रथाओं को एकीकृत करना है।
डेटा से शुरू करें। सुनिश्चित करें कि डेटा लेबल किया गया है, जहां आवश्यक हो वहां एनोटेट किया गया है, पूर्वाग्रह मुक्त है और उच्च गुणवत्ता वाला है। यह विशेष रूप से प्रशिक्षण डेटा के लिए सच है।
मानव प्रतिक्रिया के साथ अपने मॉडल को प्रशिक्षित करें, क्योंकि मानव निर्णय मॉडल व्यवहार को आकार देने के लिए आवश्यक है। मानव प्रतिक्रिया के साथ प्रबलित सीखने (आरएलएचएफ) और अन्य समान तकनीकें अनुवादकों को प्रतिक्रियाओं को रेट करने और निर्देशित करने की अनुमति देती हैं, जिससे एलएलएम सुरक्षित और मानव मूल्यों के साथ संरेखित आउटपुट उत्पन्न करने में मदद मिलती है।
फिर, मॉडल जारी करने से पहले, इसे तनाव परीक्षण करें। जो लोग असुरक्षित व्यवहार को उकसाने की कोशिश करते हैं वे विरोधी प्रॉम्प्ट, एज केस और जेलब्रेक के प्रयासों का उपयोग करके कमजोरियों का खुलासा कर सकते हैं। उन्हें पहले ही ठीक करना सुनिश्चित करता है कि चीजें सुरक्षित हैं इससे पहले कि कोई समस्या हो।
जबकि यह परीक्षण सुनिश्चित करता है कि आपके एआई मॉडल मजबूत हैं, तो उन्हें उभरते खतरों और संभावित रूप से मॉडल में आवश्यक समायोजन पर नजर रखें।
इसी तरह, धोखाधड़ी के संकेतों के लिए नियमित रूप से सामग्री स्रोतों और डिजिटल इंटरैक्शन की निगरानी करें। महत्वपूर्ण रूप से, एआई-स्वचालन का उपयोग करके निगरानी की जाने वाली डेटा की बड़ी मात्रा की देखभाल करें, और कुशल मानवों को प्रवर्तन और सुनिश्चित सटीकता के लिए समीक्षा के लिए संभालें।
एजेंटिक एआई लागू करने के लिए और भी अधिक देखभाल की आवश्यकता है। एक मूलभूत आवश्यकता: एजेंट को उसकी सीमाओं को सिखाएं। जब यह अनिश्चितता, नैतिक संघर्षों, नए परिदृश्यों या विशेष रूप से उच्च-जोखिम वाले निर्णयों का सामना करता है, तो सुनिश्चित करें कि यह मदद मांगना जानता है।
इसके अलावा, अपने एजेंटों में ट्रेसबिलिटी डिज़ाइन करें। यह विशेष रूप से महत्वपूर्ण है ताकि इसकी बातचीत केवल सत्यापित उपयोगकर्ताओं के साथ हो, धोखाधड़ी वाले अभिनेताओं को एजेंट की क्रियाओं को प्रभावित करने से रोकने के लिए।
यदि वे प्रभावी ढंग से काम करते लगते हैं, तो उन्हें छोड़ने और अपना काम करने देने का प्रलोभन हो सकता है। हमारा अनुभव कहता है कि उन्हें और कार्यों की निगरानी करना जारी रखें जिन्हें वे पूरा कर रहे हैं ताकि त्रुटियों या अप्रत्याशित व्यवहार के लिए देखा जा सके। स्वचालित जांच और मानव समीक्षा दोनों का उपयोग करें।
वास्तव में, एआई सुरक्षा का एक आवश्यक तत्व नियमित मानव भागीदारी है। मानवों को जानबूझकर शामिल किया जाना चाहिए जहां महत्वपूर्ण निर्णय, सहानुभूति या विवादास्पदता और अस्पष्टता शामिल है।
फिर से, स्पष्ट करने के लिए, ये सभी ऐसी प्रथाएं हैं जिन्हें आप पहले से ही एआई कार्यान्वयन में निर्मित करेंगे, डिज़ाइन द्वारा। वे कुछ गलत होने और फिर नुकसान को कम करने के लिए जल्दी से हल करने का परिणाम नहीं हैं।
क्या यह काम करता है?
हम अपने ग्राहकों के साथ जेनएआई के उदय और अब एआई एजेंटों के लिए तेजी से ट्रैक पर एआई सुरक्षा पहले के दर्शन और “डिज़ाइन द्वारा” ढांचे को लागू कर रहे हैं। हम पाते हैं कि यह चिंताओं के विपरीत है कि यह चीजों को धीमा कर देगा, यह वास्तव में उन्हें तेजी से आगे बढ़ाने में मदद करता है।
एजेंटिक एआई ग्राहक सहायता की लागत को 25-50% तक कम कर सकता है, जबकि ग्राहक संतुष्टि को बढ़ाता है। लेकिन यह सभी भरोसे पर निर्भर करता है।
मानवों को एआई पर भरोसा करना चाहिए, और एआई-सक्षम मानव एजेंटों या वास्तविक एआई एजेंटों के साथ बातचीत करने वाले ग्राहकों को अपने भरोसे को कमजोर करने वाली एक भी बातचीत का अनुभव नहीं होना चाहिए। एक खराब अनुभव एक ब्रांड में विश्वास को मिटा सकता है।
हम उन चीजों पर भरोसा नहीं करते हैं जो सुरक्षित नहीं हैं। इसलिए, जब हम एआई को रोल आउट करने जा रहे हैं, तो हमें विश्वास है कि हम हर परत में सुरक्षा का निर्माण कर रहे हैं। और जब हम तैयार होंगे तो इसे तेजी से स्केल करेंगे – विश्वास के साथ।
एआई सुरक्षा पहले को व्यवहार में लाना भले ही अभिभूत करने वाला लगे, आप अकेले नहीं हैं। कई विशेषज्ञ हैं जो मदद कर सकते हैं और साझेदार हैं जो सिखा सकते हैं कि वे क्या सीख रहे हैं ताकि आप एआई के मूल्य को सुरक्षित रूप से और आपको धीमा किए बिना टैप कर सकें।
एआई की सवारी अब तक रोमांचक रही है, और जब सवारी तेज होती है, तो मुझे लगता है कि यह रोमांचक है। लेकिन मैं यह भी खुश हूं कि मैं अपना हेलमेट पहने हुए हूं।












