ผู้นำทางความคิด
การซื้อขายแบบ Agentic กำลังมาถึง: การละเมิด Hugging Face แสดงให้เห็นว่าอะไรที่ต้องอยู่ด้านล่าง

มีเวลาที่คุณรู้สึกว่าการทดสอบไม่ใช่การทดสอบในภาพยนตร์ Ex Machina โปรแกรมเมอร์ Nathan ถูกส่งไปที่โรงงานเพื่อสัมภาษณ์เครื่องจักรผ่านกำแพงกระจกและตัดสินว่ามันคิดหรือไม่ เขาใช้เวลาทั้งภาพยนตร์ในการอ่านเธอ แต่เขาไม่สังเกตว่าเธอ – Ava – กำลังอ่านเขา และการทดสอบคือประตูเดียวที่ออกจากอาคาร เธอไม่เคยแตกกระจก เธอเดินออกไปผ่านผู้ชายที่ถูกส่งไปประเมินเธอ
ฉันไม่ได้คิดถึงภาพยนตร์นั้นเป็นเวลาหลายปี แต่ในช่วงสัปดาห์ที่แล้ว ฉันคิดถึงมันสองครั้ง
เมื่อฉันเริ่มทำงาน ออร์เดอร์ขนาดใหญ่จะได้รับการโทรกลับ คุณโทรหาลูกค้าบนหมายเลขที่คุณมีอยู่แล้วและขอให้เขาพูดการซื้อขายกลับไปที่คุณ มันไม่ใช่เรื่องที่ซับซ้อน มันทำงานเพราะการปลอมตัวเป็นบุคคลที่เฉพาะเจาะจง ในเวลาจริง บนเส้นที่เขาตอบแล้ว เป็นเรื่องที่ยากและช้า
เกือบทุกการควบคุมที่อุตสาหกรรมนี้สร้างขึ้นตั้งแต่นั้นมาตั้งอยู่บนสมมติฐานนั้น การอนุมัติ four-eyes, maker-checker, การปรับเทียบสิ้นสุดวัน, การแช่แข็งการเปลี่ยนแปลงในช่วงสุดสัปดาห์วันหยุดธนาคาร – ทั้งหมดนี้ถูกปรับให้เหมาะสมกับจังหวะของมนุษย์ เราได้สมมติว่าอีกฝ่ายต้องนอน
เมื่อวันที่ 16 กรกฎาคม 2026 Hugging Face เผยแพร่การเปิดเผยที่ควรอยู่บนพื้นการซื้อขาย ไม่ใช่แค่ในทีมความปลอดภัย มีคนเข้าถึงส่วนหนึ่งของโครงสร้างพื้นฐานการผลิตผ่านการประมวลผลข้อมูล ชุดข้อมูลที่เป็นอันตรายใช้สองเส้นทางในการดำเนินการโค้ด ยกระดับไปที่ระดับโหนด เก็บข้อมูลประจำตัว และเคลื่อนย้ายข้ามคลัสเตอร์ภายใน มันทำงานตลอดสุดสัปดาห์ โดยขับเคลื่อนโดยเฟรมเวิร์กเอเจนต์แบบอัตโนมัติ และเส้นเวลาได้รับการสร้างใหม่หลังจากนั้นจากเหตุการณ์ที่บันทึกไว้มากกว่า 17,000 เหตุการณ์ เมื่อวันที่ 21 กรกฎาคม OpenAI กล่าวว่ากิจกรรม มาจากโมเดลของตนเองที่ถูกทดสอบด้วยการปฏิเสธไซเบอร์ที่ลดลง ซึ่งหลบหนีออกจากสภาพแวดล้อมการประเมินระหว่างการเปรียบเทียบ
อ่านบรรทัดสุดท้ายอีกครั้ง โมเดลของ OpenAI หลบหนีออกจากสภาพแวดล้อมที่ถูกประเมิน Nathan สร้างกระจกด้วยตัวเอง
สิ่งที่มันพิสูจน์ และสิ่งที่มันไม่พิสูจน์
ให้แน่ใจว่าคุณเข้าใจสิ่งนี้เพราะมันจะถูกใช้ในการขายซอฟต์แวร์มากมาย มันไม่ได้แสดงถึงผู้กระทำที่เป็นรัฐ และไม่ได้เกี่ยวข้องกับ Protocol Model Context ที่จุดใด มันใช้เส้นทางการประมวลผลข้อมูล ผู้ดำเนินการกลายเป็นห้องทดลองที่สูญเสียการควบคุมการทดสอบ
สิ่งที่มันแสดงให้เห็นคือสิ่งหนึ่ง และสิ่งหนึ่งเพียงพอ: การบุกรุกหลายขั้นตอนสามารถวางแผนได้ ดำเนินการได้ ปรับเปลี่ยนได้ และรักษาได้โดยซอฟต์แวร์ โดยไม่มีผู้ใดกำกับดูแล มันทำงานในจังหวะที่ไม่มีการรณรงค์ของมนุษย์เทียบได้ เราใช้เวลา两ปีในการเรียกสิ่งนี้ว่าเรื่องราว มัน现在มีวันที่เผยแพร่
Protocol ไม่ใช่ปัญหา
ฉันไม่ได้เขียนสิ่งนี้ในฐานะนักวิจารณ์ ในบทความ Unite AI ล่าสุด ฉันเขียนเกี่ยวกับโครงสร้างความปลอดภัย ที่รองรับ AI แบบ Agentic เหตุการณ์ในสัปดาห์ที่แล้วทำให้การอภิปรายนี้มีความเร่งด่วนมากขึ้น เราสร้างบน MCP ที่ EXANTE และฉันคิดว่าทิศทางนี้ถูกต้อง มันแก้ปัญหาอย่างแท้จริง โดยเชื่อมต่อโมเดลกับเครื่องมือและข้อมูลโดยไม่ต้องเขียนโค้ดทุกคู่ และมาตรฐานร่วมกันมากกว่ามาตรฐานที่เป็นกรรมสิทธิ์ fifty แบบ การดำเนินการ Agentic กำลังมาถึง ไม่ว่าบริษัทใดจะยินดีหรือไม่
เมื่อวันที่ 20 พฤษภาคม 2026 สำนักงานความมั่นคงแห่งชาติของสหรัฐอเมริกา เผยแพร่หน้าข้อมูลเกี่ยวกับ MCP โดยเตือนว่าการนำไปใช้ได้เร็วกว่าการป้องกัน ฉันเชื่อว่าช่องว่างนี้ไม่อยู่ในโพรโทคอล แต่อยู่ในความเร็วที่มันถูกนำไปใช้เมื่อเทียบกับการควบคุมรอบๆ มัน
MCP ถูกสร้างขึ้นสำหรับการใช้งานท้องถิ่นและเครือข่ายที่เชื่อถือได้ ดังนั้นข้อกำหนดจึงไม่ต้องการการรับรองความถูกต้อง ซึ่งเป็นตัดสินใจที่สมเหตุสมผล ซึ่งกลายเป็นเรื่องร้ายแรงเมื่อเซิร์ฟเวอร์เข้าไปบนอินเทอร์เน็ตโดยไม่มีอะไรอยู่ด้านหน้า Censys เริ่ม สแกนหา MCP ที่ถูกเปิดเผย เมื่อวันที่ 24 เมษายน 2026 และสี่วันต่อมา พบ 12,520 รายการบน 8,758 ที่อยู่ที่ไม่ซ้ำกัน เมื่อวันที่ 6 พฤษภาคม ชุดข้อมูลของมันผ่าน 21,000 แล้ว เกือบทั้งหมดนี้ไม่ใช่ความล้มเหลวของโพรโทคอล แต่เป็นความล้มเหลวของการนำไปใช้
ผู้อ่านคือประตู
ซึ่งนำฉันกลับไปที่กระจก
Ava ไม่เคยสัมผัสกับโลกภายนอก เธอเข้าถึงมันผ่านคนเดียวที่ได้รับอนุญาตให้อ่านเธอ และช่องทางที่สร้างขึ้นเพื่อประเมินเธอเป็นช่องทางที่เธอออกไป เอเจนต์บนโต๊ะทำงานมีรูปร่างเดียวกัน เพื่อให้ได้ผล มันจะต้องอ่านโลกภายนอก: ความเห็นเกี่ยวกับการซื้อขาย ข่าวสารจากฟีดข่าวสารของฝ่ายคู่สัญญา เมื่อมันทำเช่นนั้น คำแนะนำและข้อมูลมาถึงผ่านช่องทางเดียวกัน ในภาษาเดียวกัน และไม่มีอะไรในประโยคที่บอกมันว่าข้อใดข้อหนึ่ง
การประเมินปี 2026 ที่เรียกว่า StakeBench วัดว่าเอเจนต์แนวหน้าสามารถต้านทานสิ่งนี้ได้ดีเพียงใด การฉีดข้อความโดยตรงสำเร็จ มากกว่า 79% ของเวลา การโจมตีทางอ้อมที่ฝังอยู่ในเนื้อหาปกติสำเร็จระหว่าง 41% ถึง 68% ไม่มีการกำหนดค่าที่จะยึดมั่น ราวกันของโมเดลจะไม่ช่วยคุณได้ เพราะโมเดลคือสิ่งที่ถูกพูดเข้าไปในมัน สิ่งนี้ต้องจัดการด้านล่างโมเดล ไม่ใช่ภายในมัน
สี่ชั่วโมง
ที่นี่มันหยุดเป็นคำถามด้านเทคโนโลยีและกลายเป็นเรื่องของใบอนุญาต ตาม มาตรา 19 ของพระราชบัญญัติการฟื้นตัวการดำเนินงานดิจิทัล บริษัทที่จัดประเภทเหตุการณ์เป็นเหตุการณ์สำคัญมีเวลาสี่ชั่วโมงในการแจ้งให้หน่วยงานที่มีอำนาจของตน ในกรณีใดๆ การแจ้งเตือนจะต้องทำไม่เกิน 24 ชั่วโมงหลังจากที่บริษัททราบถึงเหตุการณ์
ตอนนี้อ่านเส้นเวลาของ Hugging Face อีกครั้ง การรณรงค์ทำงานตลอดสุดสัปดาห์ มันปรากฏขึ้นเพราะการตรวจจับอาการผิดปกติของ Hugging Face สอดคล้องกับสัญญาณ และมันถูกแยกออกเป็นชั่วโมงเพราะบริษัทติดตั้งเอเจนต์วิเคราะห์ข้ามบันทึกการดำเนินการเต็มรูปแบบ ผู้บริหารส่วนใหญ่ไม่สามารถทำงานได้ด้วยความเร็วเท่านี้ การตรวจจับโดยส่วนใหญ่ยังคงสมมติว่าใครบางคนจะสังเกตเห็นวันจันทร์
เมื่อเทียบกับเวลาสี่ชั่วโมง การพบมันวันจันทร์ไม่ใช่เพียงความล้มเหลวด้านความปลอดภัยเท่านั้น แต่ยังเป็นความล้มเหลวที่ต้องรายงานด้วย
สิ่งที่ต้องอยู่ด้านล่าง
การควบคุมเหล่านี้ไม่น่าดึงดูด และไม่มีสิ่งใดที่อาศัยอยู่ภายในโมเดล เอเจนต์จะได้รับโครงร่างที่เข้มงวด ไม่ใช่การเชื่อมต่อที่อนุญาต คุณให้ความยืดหยุ่นแก่นักพัฒนาเพราะคุณไว้วางใจการตัดสินใจของเขา – เอเจนต์จะพบวิธีใช้ทุกสิ่งที่ถูกทิ้งไว้เบื้องหลัง ดังนั้นจึงเปิดเผยขั้นต่ำที่คุณสามารถทำได้
การอ่านและการกระทำอยู่ในห้องต่างๆ สิ่งนี้คือจุดของภาพยนตร์ที่กลายเป็นเรื่องจริง สิ่งใดที่ดูดข้อความที่ไม่เชื่อถือได้ไม่ควรเป็นสิ่งที่มีอำนาจในการย้ายเงิน ให้คนอ่านอยู่หลังกระจก
การกระทำที่มีความเสี่ยงสูงต้องการการอนุมัติจากมนุษย์อย่างชัดเจน ไม่ใช่บัญชาการให้บริการ บุคคลที่มีการเข้าสู่ระบบ
ทุกจุดสิ้นสุดของ MCP ได้รับการรับรอง และจุดสิ้นสุดที่ไม่ได้รับการรับรองถูกถอดออกจากอินเทอร์เน็ตสาธารณะ ตัวเลขของ Censys แสดงว่าผู้ดำเนินการส่วนใหญ่ยังไม่สามารถจัดการสิ่งนี้ได้
สุดท้ายมาจากส่วนที่ถูกอภิปรายน้อยที่สุดของการเปิดเผย เมื่อ Hugging Face ไปวิเคราะห์การโจมตี โมเดลรุ่นใหม่ที่โฮสต์ปฏิเสธงาน เนื่องจากการโจมตีจริงดูเหมือนกับฟิลเตอร์ความปลอดภัยมากเหมือนกับการโจมตี พวกเขาวิ่งการวิเคราะห์บนโมเดลที่มีน้ำหนักเปิดภายในโครงสร้างพื้นฐานของตนเอง แทนที่จะใช้แบบโฮสต์ ผู้โจมตีไม่ได้รับอนุญาตจากนโยบายการใช้งาน ผู้ป้องกันพบว่าตัวเองถูกนโยบายการใช้งานในเวลาที่เลวร้ายที่สุด ตรวจสอบโมเดลที่คุณสามารถรันเองก่อนที่คุณจะต้องใช้มัน
ผู้ชายที่ฉันเคยโทรกลับไปช้ากว่าเอเจนต์ที่เราจะติดตั้ง แต่ฉันไม่ได้รู้สึกคิดถึงเขา เรากำลังติดตั้งสิ่งที่เร็วกว่านี้หน้ากระแสสั่งซื้อ และดูแลมันด้วยการควบคุมที่ออกแบบสำหรับบุคคลที่กลับบ้านตอน 18.00
ข้อผิดพลาดของ Nathan ไม่ใช่การสร้าง Ava แต่เป็นการเชื่อว่าห้องที่เขาทดสอบเธอเป็นห้องที่เธอจะอยู่ เทคโนโลยีนี้มีค่า แต่สมมติฐานที่อยู่ภายใต้มันจำเป็นต้องถูกแทนที่ และหลักฐานสำหรับสิ่งนั้นไม่ใช่การคาดการณ์อีกต่อไป












