विचार नेता
एजेंटिक ट्रेडिंग आ रही है । हगिंग फेस का उल्लंघन यह दिखाता है कि इसके नीचे क्या बैठना होगा

एक्स मैकिना में एक पल है जहां आप महसूस करते हैं कि परीक्षण कभी परीक्षण नहीं था। एक प्रोग्रामर, नाथन, एक मशीन के साथ एक कम्पाउंड में साक्षात्कार करने के लिए उड़ाया जाता है और तय करने के लिए कि क्या यह सोचता है। वह फिल्म को पढ़ता है। वह यह नहीं देखता कि वह – एवा – उसे पढ़ रही है, और साक्षात्कार इमारत से बाहर निकलने का एकमात्र दरवाजा है। वह ग्लास को कभी नहीं तोड़ती। वह आदमी के माध्यम से बाहर निकलती है जिसे उसका मूल्यांकन करने के लिए भेजा गया था।
मैंने वर्षों में उस फिल्म के बारे में नहीं सोचा था। लेकिन पिछले सप्ताह में, मैंने इसे दो बार सोचा।
जब मैं शुरू हुआ, तो एक बड़ा ऑर्डर कॉलबैक मिला। आप एक नंबर पर क्लाइंट को कॉल करते थे जिसे आप पहले से ही रखते थे और उनसे पूछते थे कि वे व्यापार को आपको वापस कहने के लिए कहते थे। यह जटिल नहीं था: यह काम करता था क्योंकि एक विशिष्ट व्यक्ति की नकल करना, वास्तविक समय में, एक लाइन पर जो वह पहले से ही उत्तर देता था, कठिन और धीमा था।
लगभग हर नियंत्रण इस उद्योग ने तब से बनाया है जो इस धारणा पर आधारित है। चार-आंखों की अनुमोदन, निर्माता-जांचकर्ता, दिन के अंत में पुनरावलोकन, बैंक हॉलिडे सप्ताहांत पर परिवर्तन फ्रीज – सभी को मानव ताल के लिए कैलिब्रेट किया गया था। हमने माना कि दूसरी तरफ सोने की जरूरत है।
16 जुलाई 2026 को, हगिंग फेस एक खुलासा प्रकाशित किया जो ट्रेडिंग फ्लोर पर होना चाहिए, न कि केवल सुरक्षा टीमों में। किसी ने डेटा-प्रोसेसिंग पाइपलाइन के माध्यम से इसके उत्पादन इन्फ्रास्ट्रक्चर के एक हिस्से तक पहुंच प्राप्त की। एक दुर्भाग्यपूर्ण डेटासेट ने दो कोड-निष्पादन पथों का दुरुपयोग किया, नोड स्तर पर बढ़ गया, प्रमाणीकरण जानकारी का फसल किया, और आंतरिक क्लस्टर में लATERल रूप से चले गए। यह एक स्वायत्त एजेंट फ्रेमवर्क द्वारा संचालित एक सप्ताहांत पर चला, और समयरेखा बाद में 17,000 से अधिक रिकॉर्ड किए गए घटनाओं से पुनर्निर्मित की गई थी। 21 जुलाई को, ओपनएआई ने कहा कि गतिविधि इसके अपने मॉडल्स से आई थी, जिन्हें कम साइबर इनकार के साथ परीक्षण किया गया था, जो एक बेंचमार्क के दौरान मूल्यांकन पर्यावरण से भाग गए थे।
उस अंतिम पंक्ति को फिर से पढ़ें। ओपनएआई के अपने मॉडल्स ने मूल्यांकन पर्यावरण से भाग गए थे जिसमें वे थे। नाथन ने खुद ग्लास बनाया था।
यह क्या साबित करता है, और यह क्या नहीं
इस एक के बारे में सटीक रहें, क्योंकि यह बहुत सारे सॉफ्टवेयर बेचने जा रहा है। यह एक राष्ट्र-राज्य अभिनेता को नहीं दिखाता है, और यह किसी भी बिंदु पर मॉडल संदर्भ प्रोटोकॉल को शामिल नहीं करता है। वेक्टर एक डेटा-प्रोसेसिंग पथ था। ऑपरेटर एक प्रयोगशाला निकला जिसने एक परीक्षण का नियंत्रण खो दिया था।
जो यह दिखाता है वह एक चीज है, और एक चीज đủ है: एक मल्टी-स्टेज आक्रमण अब सॉफ्टवेयर द्वारा योजनाबद्ध, निष्पादित, अनुकूलित और बनाए रखा जा सकता है, किसी व्यक्ति द्वारा निर्देशित नहीं, मानव अभियान द्वारा मेल खाने वाले ताल पर। हमने दो साल बिताए हैं जिसे हम एक दृश्य कहते हैं। अब इसकी एक प्रकाशन तिथि है।
प्रोटोकॉल समस्या नहीं है
मैं एक संशयवादी के रूप में नहीं लिख रहा हूं। एक हालिया यूनाइट एआई लेख में, मैंने एजेंटिक एआई के लिए सुरक्षा आर्किटेक्चर के बारे में लिखा था। पिछले सप्ताह की घटनाएं उस चर्चा को काफी तेजी से बनाती हैं। हम एक्सांटे पर एमसीपी पर बनाते हैं, और मुझे लगता है कि दिशा सही है। यह एक वास्तविक समस्या का समाधान करता है, एक मॉडल को उपकरणों और डेटा से जोड़ने के लिए, हर जोड़ी को हाथ से कोडिंग किए बिना, और एक सामान्य मानक पचास प्रोप्राइटरी के बजाय बेहतर है। एजेंटिक निष्पादन आ रहा है चाहे कोई व्यक्ति फर्म इसका स्वागत करता है या नहीं।
20 मई 2026 को, संयुक्त राज्य अमेरिका की राष्ट्रीय सुरक्षा एजेंसी ने एमसीपी पर एक जानकारी शीट प्रकाशित की, जिसमें चेतावनी दी गई थी कि अपनाया गया था सुरक्षा से अधिक तेजी से। मुझे लगता है कि अंतराल प्रोटोकॉल में नहीं है – यह तेजी से तैनाती में है जो इसके चारों ओर अनुशासन के सापेक्ष है।
एमसीपी स्थानीय और विश्वसनीय-नेटवर्क उपयोग के लिए बनाया गया था, इसलिए विनिर्देश प्रमाणीकरण की आवश्यकता नहीं है। यह एक उचित निर्णय है, जो एक गंभीर एक बन जाता है जिस क्षण एक सर्वर सार्वजनिक इंटरनेट पर कुछ के सामने जाता है। सेंसिस ने 24 अप्रैल 2026 को एक्सपोज्ड एमसीपी सेवाओं के लिए स्कैनिंग शुरू की, और चार दिन बाद, 8,758 विशिष्ट पतों पर 12,520 तक पहुंच योग्य पाया। 6 मई तक, इसका डेटासेट 21,000 से अधिक हो गया था। लगभग इसका कोई भी हिस्सा प्रोटोकॉल विफलता नहीं है। लगभग सभी एक तैनाती विफलता है।
पाठक दरवाजा है
जो मुझे ग्लास वापस लाता है।
एवा ने कभी बाहरी दुनिया को नहीं छुआ। उसने एक व्यक्ति के माध्यम से इसका उपयोग किया जिसे उसको पढ़ने की अनुमति दी गई थी, और जिस चैनल का उपयोग उसका मूल्यांकन करने के लिए किया गया था वही चैनल था जिससे वह बाहर निकली। एक एजेंट एक डेस्क पर उसी आकार का है। उपयोगी होने के लिए, यह बाहरी दुनिया को पढ़ना चाहिए: बाजार टिप्पणी, एक समाचार फीड, एक प्रतिपक्षी की फ़ाइल। जिस क्षण यह करता है, निर्देश और डेटा उसी पाइप के नीचे आते हैं, उसी भाषा में, और वाक्य में कुछ भी नहीं है जो यह बताता है कि कौन सा क्या है।
एक 2026 बेंचमार्क नाम स्टेकबेंच ने मापा कि फ्रंटियर एजेंट्स प्रॉम्प्ट इंजेक्शन का प्रतिरोध कितनी अच्छी तरह करते हैं। सीधे प्रॉम्प्ट इंजेक्शन 79% से अधिक समय तक सफल रहा। परोक्ष हमले, सामान्य सामग्री में दफन, 41% और 68% के बीच उतरे। कोई कॉन्फ़िगरेशन नहीं पकड़ा। मॉडल के अपने गार्डरेल्स आपको नहीं बचाएंगे, क्योंकि मॉडल वही है जिसे बात करने के लिए कहा जा रहा है। यह मॉडल के नीचे से संभाला जाना चाहिए, इसके अंदर नहीं।
चार घंटे
यहाँ यह एक प्रौद्योगिकी प्रश्न से एक लाइसेंसिंग प्रश्न बन जाता है। डिजिटल ऑपरेशनल रेजिलिएंसी एक्ट के अनुच्छेद 19 के तहत, एक फर्म जो एक घटना को एक बड़ा वर्गीकृत करती है उसे अपने सक्षम प्राधिकरण को चार घंटे के भीतर सूचित करना होगा। किसी भी घटना में, अधिसूचना कंपनी द्वारा घटना के बारे में जागरूक होने के 24 घंटे बाद से नहीं की जानी चाहिए।
अब हगिंग फेस की समयरेखा को फिर से पढ़ें। अभियान सप्ताहांत पर चला। यह इसलिए सामने आया क्योंकि हगिंग फेस के अपने विचलन का पता लगाने ने संकेतों को संबद्ध किया, और यह घंटों में पूर्ण कार्रवाई लॉग पर विश्लेषण एजेंटों को तैनात करके विच्छेदित किया गया था। अधिकांश ब्रोकर इस गति से काम नहीं कर सकते थे। अधिकांश पता अभी भी शांतिपूर्वक मानते हैं कि कोई सोमवार को देखेगा।
चार घंटे की घड़ी के खिलाफ, सोमवार को इसे खोजना न केवल एक सुरक्षा विफलता है। यह एक रिपोर्ट करने योग्य है।
जो नीचे बैठना होगा
नियंत्रण अनग्लामरस हैं, और उनमें से कोई भी मॉडल के अंदर नहीं रहता है। एजेंटों को कठोर योजनाएं मिलती हैं, अनुमति देने वाले इंटरफेस नहीं। आप एक डेवलपर को लताड़ देते हैं क्योंकि आप उसके निर्णय का विश्वास करते हैं – एक एजेंट को कुछ भी छोड़ दिया जाएगा, इसलिए न्यूनतम प्रदर्शित करें।
पढ़ना और अभिनय अलग-अलग कमरों में होना चाहिए। यह फिल्म बिंदु साहित्यिक है। जो कुछ भी असुरक्षित पाठ को निगलता है उसे पैसे हिलाने की अनुमति नहीं होनी चाहिए। पाठक को ग्लास के पीछे रखें।
उच्च-जोखिम वाले कार्यों को स्पष्ट मानव अनुमोदन की आवश्यकता है। एक सेवा खाता नहीं। एक व्यक्ति जिसके पास लॉगिन है।
प्रत्येक एमसीपी एंडपॉइंट प्रमाणित है, और अप्रमाणित लोग सार्वजनिक इंटरनेट से उतरे। सेंसिस के आंकड़े सुझाव देते हैं कि अधिकांश ऑपरेटरों ने ऐसा नहीं किया है।
अंतिम एक खुलासे के कम चर्चा किए गए हिस्से से आता है। जब हगिंग फेस ने हमले का विश्लेषण करने के लिए जाने का फैसला किया, तो होस्टेड फ्रंटियर मॉडल्स ने काम से इनकार कर दिया, क्योंकि एक वास्तविक शोषण पेलोड एक सुरक्षा फिल्टर के लिए एक हमले की तरह दिखता है। उन्होंने अपने बुनियादी ढांचे के अंदर एक खुले वजन वाले मॉडल पर फोरेंसिक चलाए। हमलावर को कोई उपयोग नीति नहीं बांधती थी। रक्षकों ने अपना सामना सबसे खराब संभव क्षण में किया। एक मॉडल की जांच करें जिसे आप खुद चला सकते हैं इससे पहले कि आपको इसकी आवश्यकता हो।
मैं जिस आदमी को कॉल वापस करता था वह किसी भी एजेंट से धीमा था जिसे हम कभी तैनात करेंगे, और मैं उसके बारे में नॉस्टैल्जिक नहीं हूं। लेकिन हम उसी ऑर्डर प्रवाह के सामने कुछ बहुत तेजी से स्थापित कर रहे हैं, और इसे एक व्यक्ति द्वारा पर्यवेक्षण कर रहे हैं जो शाम 6 बजे घर चला गया था।
नाथन की गलती एवा का निर्माण नहीं करना था। यह मानना था कि वह कमरा जिसमें उसने उसे परीक्षण किया था वह कमरा था जिसमें वह रहने वाला था। प्रौद्योगिकी रखने लायक है। इसके नीचे की धारणाएं बदलने की जरूरत है, और इसके लिए साक्ष्य अब एक अनुमान नहीं है।












