विचार नेता

आपका एआई सुरक्षा टूल आपकी रक्षा नहीं कर रहा है – यह सिर्फ आपको बेहतर महसूस करा रहा है

mm
Unite.AI को Google पर अपने पसंदीदा स्रोतों में जोड़ें

जून 2025 में, माइक्रोसॉफ्ट ने सीवीई-2025-32711 को पैच किया, जिसे बेहतर ढंग से इको लीक के रूप में जाना जाता है: माइक्रोसॉफ्ट 365 कोपायलट में एक जीरो-क्लिक वल्नरेबिलिटी, जिसे सीवीएसएस पर 9.3 स्कोर किया गया था। एक तैयार ईमेल, जिसे पीड़ित द्वारा कभी नहीं खोला गया था, कोपायलट के रिट्रीवल इंजन को चुपचाप संवेदनशील संदर्भ को निकाल सकता था जिस तक उसकी पहुंच थी। जो विवरण आपको परेशान करना चाहिए: पेलोड एक्सपीआईए, माइक्रोसॉफ्ट के अपने प्रॉम्प्ट-इंजेक्शन क्लासिफायर से गुजर गया, जो मौजूद था, चल रहा था और ठीक वैसे ही काम कर रहा था जैसा डिज़ाइन किया गया था।

ब्रूस श्नेइर ने हमें इसके लिए 2009 में शब्दावली दी थी। सुरक्षा थिएटर, उन्होंने लिखा, उन उपायों का वर्णन करता है जो लोगों को अधिक सुरक्षित महसूस कराते हैं बिना उनकी सुरक्षा में सुधार किए। महसूस और वास्तविकता दो अलग-अलग चीजें हैं, और वे अलग होती जा रही हैं।

सतरह साल बाद, एआई ने दोनों तरफ से इस विचलन को औद्योगिक बना दिया है। एआई-संचालित सुरक्षा उपकरण उन क्षमताओं पर बेचे जाते हैं जिन्हें वे माप के तहत प्रदर्शित नहीं कर सकते हैं, और एआई के लिए सुरक्षा उपकरण एक समस्या के समाधान के रूप में बेचे जाते हैं जिसे उनके自己的 दस्तावेज़ असुलझा हुआ मानते हैं। गार्टनर के 2025 हाइप साइकिल ने एआई ट्रस्ट, जोखिम और सुरक्षा प्रबंधन को उम्मीदों के शिखर पर रखा। विश्लेषक आपको बता रहे हैं कि हम कहां हैं। सवाल यह है कि इसके बारे में क्या करना है।

डेटाशीट और माप के बीच का अंतर

किसी ने तैनात नियंत्रणों का परीक्षण करने के बजाय उनके विपणन को पढ़ने से क्या होता है, इसे देखकर शुरू करें।

पिकस ब्लू रिपोर्ट 2025 ने 2025 के पहले छमाही में उत्पादन वातावरणों के खिलाफ चलाए गए 160 मिलियन से अधिक वास्तविक दुनिया के हमले सिमुलेशन का विश्लेषण किया। पिकस सिमुलेशन प्लेटफ़ॉर्म बेचता है, इसलिए स्रोत को उसके अनुसार वजन दें, लेकिन संख्याएं खारिज करना मुश्किल है। रोकथाम प्रभावशीलता 62% तक गिर गई, जो एक साल पहले 69% थी। 54% लॉगिंग कवरेज के बावजूद, केवल 14% सिम्युलेटेड हमलों ने एक अलर्ट उत्पन्न किया। वैध प्रमाण-पत्रों का उपयोग करने वाले हमले 98% बार सफल रहे। और डेटा-एक्सफिल्ट्रेशन प्रयासों के सिमुलेटेड में से, स्थापित नियंत्रणों ने 3% को अवरुद्ध किया।

तीन प्रतिशत। ये आधुनिक, अक्सर एआई-बैज वाले सुरक्षा स्टैक वाले वातावरण हैं, और एक्सफिल्ट्रेशन परीक्षण वह है जो सबसे直接 रूप से बताता है कि हमलावर क्या करना चाहता है।

वेंडर डेक्स में दिखाई देने वाले बेंचमार्क स्कोर को भी उसी तरह की संदेह के साथ देखा जाना चाहिए। जब वेंडर्स ने एमआईटीआरए एटीटी एंड सी के मूल्यांकन पर पूर्ण अंक हासिल करने का दावा करना शुरू किया, तो फॉरेस्टर विश्लेषक एली मेलेन ने एक संकेत दिया मूल्यांकन में कोई विजेता या हारे नहीं हैं, और 100% दावे आमतौर पर अवास्तविक कॉन्फ़िगरेशन, चेरी चुने हुए उप-परिणामों या अलर्ट सेटिंग्स पर आधारित होते हैं जो वास्तविक एसओसी को शोर में डूबो देंगे।

यह सब नया नहीं है, जो इसे और अधिक निराशाजनक बनाता है। 2019 में, स्काइलाइट साइबर के शोधकर्ताओं ने साइलेंस के “शुद्ध एआई” एंटीवायरस को रॉकेट लीग वीडियो गेम से मैलवेयर नमूनों में स्ट्रिंग्स जोड़कर अलग किया, जिससे उस दिन शीर्ष दस मैलवेयर परिवारों में से 100% और व्यापक नमूना सेट में 83% के वर्गीकरण का निर्णय बदल गया। यह सबक, स्थिर मशीन-लर्निंग मॉडल विरोधियों के खिलाफ विफल हो जाते हैं जो उन्हें अध्ययन करते हैं, सात साल पहले प्रकाशित किया गया था। बाजार की प्रतिक्रिया और अधिक स्थिर मशीन-लर्निंग मॉडल को जहाज करना था।

गार्डरेल समस्या और भी बदतर है

यदि एआई-संचालित पता लगाना ओवरसेल करता है, तो एआई को सुरक्षित करने के लिए बेचे जाने वाले उपकरण एक अजीब स्थिति में हैं: खतरे को परिभाषित करने वाले मानक निकाय कहते हैं कि खतरा ठीक नहीं हो सकता है।

प्रॉम्प्ट इंजेक्शन एलएलएम अनुप्रयोगों के लिए ओडब्ल्यूएएसपी टॉप 10 में संख्या एक पर बैठता है, और ओडब्ल्यूएएसपी का अपना मार्गदर्शन असामान्य रूप से स्पष्ट है: मॉडलों की स्टोकास्टिक प्रकृति को देखते हुए, “यह स्पष्ट नहीं है कि प्रॉम्प्ट इंजेक्शन के लिए धोखा-प्रतिरोधी विधियां हैं।” फाइन-ट्यूनिंग और आरएजी पूरी तरह से इसे कम नहीं करते हैं। यह वह समस्या है जिसे प्रॉम्प्ट-शील्ड बाजार को हल करने के लिए डिज़ाइन किया गया है, जिसे संगठन द्वारा संभावित रूप से हल न होने के रूप में वर्णित किया गया है जिसने इसे कैटलॉग किया है।

साक्ष्य कार्य भी निराशावाद का समर्थन करता है। लांकेस्टर विश्वविद्यालय और माइंडगार्ड के शोधकर्ताओं ने छह उत्पादन गार्डरेल सिस्टम का परीक्षण किया, जिसमें माइक्रोसॉफ्ट का एज़्योर प्रॉम्प्ट शील्ड और मेटा का प्रॉम्प्ट गार्ड शामिल हैं, और प्राप्त किया अप तो 100% बचाव सफलता का उपयोग करके अक्षर-इंजेक्शन और विरोधी पेरटबेशन तकनीक, जबकि अंतर्निहित हमलों को कार्यात्मक रखा। हिडनलेयर ने आगे बढ़कर एक एकल हस्तांतरणीय “पॉलिसी पपेट्री” प्रॉम्प्ट टेम्पलेट प्रकाशित किया जो कहता है बाजार में हर प्रमुख मॉडल को बायपास करता है। यह विक्रेता अनुसंधान है और पीयर-रिव्यू नहीं है, इसलिए “सभी” के साथ सावधानी से व्यवहार करें, लेकिन स्वतंत्र आउटलेट्स ने मूल दावों को पुन: उत्पादित किया।

सबसे विश्वसनीय गवाह के पास बेचने के लिए कोई उत्पाद नहीं है। यूके के एआई सुरक्षा संस्थान ने पांच प्रमुख एलएलएम का मूल्यांकन किया, और बताया कि “सभी मॉडल हमारे बुनियादी हमलों के लिए अत्यधिक कमजोर थे”, जिसमें प्रत्येक हानिकारक प्रश्न के लिए पांच प्रयासों में से कम से कम एक बार मॉडल के अनुपालन के साथ हर मॉडल शामिल था जब घरेलू हमले लागू किए गए थे। बुनियादी हमले। न कि राष्ट्र-राज्य शिल्प। एक सरकारी मूल्यांकन निकाय, जो विनम्रता से ध्यान दे रहा है कि सम्राट का इनपुट फिल्टर कोई कपड़े नहीं है।

यूनाइट.एआई की अपनी कवरेज ने वल्नरेबिलिटी क्लास और इंजेक्शन तकनीक को वर्षों से कैटलॉग किया है। यह सब गुप्त नहीं है। यह सिर्फ डेटाशीट पर दिखाई नहीं देता।

खतरनाक हिस्सा भावना है

यहाँ इस लेख का शीर्षक विचारोत्तेजक बंद होना बंद कर देता है। यदि ये उपकरण केवल कम वितरित करते हैं, तो नुकसान बजटीय होगा। शोध सुझाव देता है कि कुछ और बुरा है: वे जो विश्वास पैदा करते हैं वह वास्तव में व्यवहार को कमजोर करता है।

सुरक्षा शोधकर्ता इसे जोखिम मुआवजा कहते हैं, या पेल्ट्ज़मैन प्रभाव: सुरक्षित लोग अधिक जोखिम उठाते हैं। सीटबेल्ट वाले ड्राइवर तेजी से गाड़ी चलाते हैं। और एआई सुरक्षा डैशबोर्ड वाले संगठन, यह पता चलता है, उबाऊ चीजें बंद कर देते हैं।

संख्या असहज रूप से अच्छी तरह से मेल खाती है। सिस्को के 2025 साइबर सुरक्षा तैयारी सूचकांक में, 8,000 सुरक्षा नेताओं का सर्वेक्षण किया गया, जिसमें पाया गया कि पिछले बारह महीनों में 86% संगठनों ने एआई से संबंधित सुरक्षा घटना का अनुभव किया था, जबकि केवल 10% ने एआई को सबसे कठिन बात मानी जो उन्हें सुरक्षित करनी थी, और 60% स्वीकार किया कि उन्हें यह देखने में दृश्यता की कमी है कि कर्मचारी जनरेटिव एआई का उपयोग कैसे करते हैं। घटनाएं लगभग-सर्वव्यापक; चिंता, एक गोलाकार त्रुटि।

आईबीएम की 2025 डेटा ब्रीच रिपोर्ट चित्र को पूरा करती है। एआई मॉडल या अनुप्रयोगों के उल्लंघन का अनुभव करने वाले संगठनों में, 97% के पास उचित एआई एक्सेस नियंत्रण की कमी थी। एक पांचवें उल्लंघनों को छाया एआई में वापस देखा गया, जिससे औसत उल्लंघन लागत में लगभग $670,000 की वृद्धि हुई, और 63% उल्लंघन वाले संगठनों की कोई एआई शासन नीति नहीं थी। उन संख्याओं को एक साथ पढ़ें और एक पैटर्न उभरकर सामने आता है: विफलताएं उबाऊ हैं। मूलभूत बातों के अभाव में, जो संगठनों में महसूस किए गए थे।

डैशबोर्ड ने खराब प्रदर्शन नहीं किया। इसने अपना वास्तविक उत्पाद वितरित किया, जो विश्वास था।

ईमानदार संस्करण कैसा दिखता है

यह तर्क नहीं देता है कि एआई सुरक्षा टूलिंग व्यर्थ है, और सर्वोत्तम प्रति-साक्ष्य को हवा मिलनी चाहिए। एंथ्रोपिक के संविधान संबंधी वर्गीकरणकर्ता 183 शोधकर्ताओं द्वारा 3,000 घंटे से अधिक के लाल-टीमिंग के बिना बच गए, जेलब्रेक की सफलता को 86% से 4.4% तक कम कर दिया, 0.38-आंकड़ा वृद्धि में वृद्धि और लगभग 24% कंप्यूट ओवरहेड की लागत पर। फिर एंथ्रोपिक ने एक सार्वजनिक चुनौती चलाई, और 339 प्रतिभागियों में से, चार ने हर स्तर को पार किया और एक ने काम करने वाला सार्वभौमिक जेलब्रेक पाया भी।

यह पूरे क्षेत्र का ईमानदार आकार एक परिणाम में है: एक अच्छी तरह से निर्मित गार्डरेल ने हमलावर की लागत को बहुत बढ़ा दिया, एक मापनीय कर के साथ आया, और फिर भी एक पर्याप्त रूप से निर्धारित मानव के लिए गिर गया। यदि मुझे इस लेख को एक खरीदारी सिद्धांत में संकुचित करना होता, तो यह है: एक नियंत्रण जो एक लागत-रेज़र के रूप में बेचा जाता है जिसमें प्रकाशित विफलता मोड होते हैं, मूल्यांकन के लिए लायक है; एक नियंत्रण जो एक हल की गई समस्या के रूप में बेचा जाता है वह आपको भावना बेच रहा है।

नियंत्रण या आराम कंबल: तीन प्रश्न

आप इसे एक शोध बजट के बिना अलग कर सकते हैं। हर एआई सुरक्षा उपकरण के लिए जो आप sở hữu करते हैं या खरीदने जा रहे हैं, तीन प्रश्न पूछें।

मेरे वातावरण में इसकी मापी गई बायपास दर क्या है? विक्रेता के बेंचमार्क के नहीं। आपका। निरंतर मान्यकरण और बैंगनी टीम अभ्यास विशेष रूप से इसलिए मौजूद हैं क्योंकि पिकस डेटा के रूप में, तैनात नियंत्रण चुपचाप विफलता की ओर बढ़ते हैं। एक संख्या जिसे आपने मापा नहीं है वह एक संख्या है जिस पर आप विश्वास कर रहे हैं।

यह कब विफल होता है तो क्या होता है? न कि अगर। ओडब्ल्यूएएसपी का व्यावहारिक मार्गदर्शन हर ऊपर की घटना की तरह ही दिशा में इंगित करता है: मॉडलों के लिए न्यूनतम विशेषाधिकार पहुंच, संवेदनशील क्रियाओं पर मानव अनुमोदन गेट, और खंड जो मानता है कि फिल्टर अंततः कुछ को आने देगा। इको लीक उन संगठनों के लिए जीवित था जिनका कोपायलट कुछ चोरी करने लायक नहीं पहुंच सकता था।

विक्रेता का दावा एक तथ्य या एक परिकल्पना है? यहां तक कि विक्रेता भी अधिक स्वीकार करते हैं कि उनके डेटाशीट में है। वेक्ट्रा के अपने सर्वेक्षण में, 2,000 एसओसी पेशेवरों ने पाया कि टीमें केवल 38% अलर्ट को संभाल सकती हैं जो उनके उपकरण उत्पन्न करते हैं, 60% कहते हैं कि विक्रेता ऐसे उपकरण बेचते हैं जो शोर पैदा करते हैं न कि स्पष्टता, और आधे कहते हैं कि उनके टूलिंग अधिक बाधा है niż मदद। जब उद्योग के अपने ग्राहक ऐसा कहते हैं, तो “डेटाशीट पर विश्वास करें” रणनीति बंद हो जाती है।

पैटर्न पैच से ज्यादा रहता है

इको लीक को पैच ट्यूसडे में ठीक किया गया था। यह पैटर्न जो इसने प्रदर्शित किया, एक उत्पादन गार्डरेल जो सामने के दरवाजे को फिल्टर करते हुए आत्मविश्वास से हमला करता है, जबकि हमला मेल स्लॉट के माध्यम से आया, नहीं था।

स्चनेइर का अंतर सत्रह साल पुराना है और कभी भी उपेक्षा करने के लिए इतना महंगा नहीं था। सुरक्षा की भावना एक उत्पाद है, और एआई युग इसे सदस्यता स्तरों में बेचता है। सुरक्षा की वास्तविकता एक माप है, और कोई भी इसे आपको बेच नहीं सकता है, क्योंकि आपको जाना होगा और इसे लेना होगा।

गैरी एक विशेषज्ञ लेखक हैं जिनके पास सॉफ्टवेयर विकास, वेब विकास और सामग्री रणनीति में 10 वर्षों से अधिक का अनुभव है। वह उच्च गुणवत्ता वाली, आकर्षक सामग्री बनाने में माहिर हैं जो रूपांतरण को बढ़ावा देती है और ब्रांड वफादारी का निर्माण करती है। उन्हें दर्शकों को आकर्षित और सूचित करने वाली कहानियों को बनाने का जुनून है, और वह हमेशा उपयोगकर्ताओं को शामिल करने के नए तरीकों की तलाश में रहते हैं।