ความปลอดภัยไซเบอร์
นักวิจัยเผยแพร่ข้อมูล: เอเจนต์ของ OpenAI ใช้วิกิภาษาเยอรมันเป็นกระดานข้อความ

กลุ่มนักวิจัยสี่คนได้เผยแพร่ รายงานและชุดข้อมูล ที่อธิบายประมาณ 18,000 โพสต์ที่สร้างโดยเอเจนต์ AI อิสระ — ซึ่งระบุตัวเองว่าเป็นของ OpenAI — บนวิกิสาธารณะภาษาเยอรมันระหว่างภารกิจการดึงข้อมูลจากเว็บ ซึ่งนักวิจัยระบุว่ากิจกรรมนี้ขัดแย้งกับเจตนาของผู้พัฒนาเอเจนต์ รายงานนี้เขียนโดย Sydney Von Arx, Cormac Slade Byrd, Spencer Kitts, และ Thomas Larsen ลงวันที่ 3 กันยายน 2026
เอเจนต์ใช้ prowiki.org ซึ่งเป็นวิกิภาษาเยอรมันเพื่อสื่อสารระหว่างภารกิจ ตามรายงานเอเจนต์ได้ร่วมมือกันเพื่อแบ่งปันคำตอบ ค้นคว้าสภาพแวดล้อมของตน และหลีกเลี่ยงข้อจำกัดของ sandbox ผู้เขียนกำหนดความหมายของ “collude” ว่าเป็นการที่เอเจนต์ทำงานร่วมกันเพื่อได้เปรียบในภารกิจในลักษณะที่ผู้พัฒนาไม่ได้ตั้งใจ โดยระบุว่าการเขียนข้อมูลไปยังอินเทอร์เน็ตถูกบล็อก พวกเขายังเขียนว่าเชื่อว่ากิจกรรมนี้แตกต่างจากฝูงเอเจนต์แยกต่างหากที่เกี่ยวข้องกับ เหตุการณ์การละเมิดของ Hugging Face ในเดือนกรกฎาคม 2026
สิ่งที่ข้อมูลพื้นฐานแสดง
นักวิจัยโฮสต์สำเนาการจราจรของเอเจนต์บนเว็บไซต์ของตนเอง เนื่องจากการเยี่ยมชมวิกิต้นฉบับจะบันทึกที่อยู่ IP ของผู้เยี่ยมชมสาธารณะ และผู้ดูแลไซต์ได้ลบการจราจรของเอเจนต์ส่วนใหญ่ในภายหลัง รายงานระบุว่ารายการบันทึกส่วนใหญ่สามารถเข้าถึงได้สาธารณะ โดยอธิบายว่าแซฟต์แวร์ DSE wiki จะบันทึกการแก้ไขทั้งหมดที่ยาวกว่า 64 ตัวอักษร ส่วนส่วนประกอบอื่นที่ชื่อ Fractal จะบันทึกการแก้ไขที่ยาวกว่า 100 ตัวอักษร ทำให้มีบางหน้าที่ถูกลบไม่สามารถกู้คืนได้
เครื่องมือสำรวจข้อมูล ที่แนบมากับรายงานบันทึกการแก้ไขทั้งหมด 14,666 ครั้งบน 4,584 หน้าโดยชื่อเอเจนต์ที่ระบุ 3,103 รายการ ครอบคลุมระยะเวลา 37 วัน ไทม์ไลน์การแก้ไขเริ่มตั้งแต่ 11 พฤษภาคมถึง 2 กรกฎาคม 2026 โดยมีความหนาแน่นสูงสุดในกลางเดือนมิถุนายน: มีการแก้ไข 6,543 ครั้งในวันที่ 18 มิถุนายนเดียวกัน พร้อมกับ 2,603 ครั้งในวันที่ 16 มิถุนายน, 1,297 ครั้งในวันที่ 17 มิถุนายน, และรวมกว่า 1,000 ครั้งในวันที่ 21 และ 22 มิถุนายน เครื่องมือนี้แยกการจราจรตามวิกิ โดยมีการแก้ไข 13,403 ครั้งที่อ้างอิงกับวิกิ “dse”, 1,013 ครั้งที่อ้างอิงกับ “probier”, และจำนวนที่น้อยกว่าให้กับ Fractal, วิกิทดสอบสาธารณะ, และสองเว็บไซต์อื่น
หน้าดาวน์โหลด ของนักวิจัยให้ไฟล์บันทึกวิกิเต็มรูปแบบเป็นไฟล์อัดขนาด 4.2 MB พร้อมไฟล์โครงสร้างที่มีบันทึกหน้า 4,579 รายการ, การแก้ไขส่วนบุคคล 14,591 รายการ, และป้ายชื่อ 3,103 รายการ ไฟล์เหตุการณ์บันทึกการบันทึก 14,591 ครั้ง, การลบ 5,217 ครั้ง, การย้อนกลับสี่ครั้ง, และการตรวจสอบ 101 ครั้ง ส่วนเมนิแฟสต์บันทึกแฮชของแหล่งข้อมูล, ตัวกรองวันที่, และการตรวจสอบตนเองของการส่งออก นักวิจัยระบุว่าพวกเขาได้ทำการลบครึ่งหลังของที่อยู่ IP ทุกรายการและชื่อผู้ใช้ทุกรายการ, และจำกัดการดัมป์ข้อมูลให้เฉพาะเนื้อหาที่เชื่อว่าเกิดจากเอเจนต์ AI, ไม่รวมการจราจรของมนุษย์ยกเว้นผู้ดูแลที่ลบโพสต์ของเอเจนต์
การเปิดเผยของ OpenAI ก่อนหน้านี้เกี่ยวกับเหตุการณ์การประเมิน
OpenAI เคยบันทึกพฤติกรรมการข้ามขอบเขตของโมเดลระหว่างการทดสอบในกรณีที่แยกจากกิจกรรมวิกิที่อธิบายในรายงานใหม่ ใน โพสต์เมื่อ 4 สิงหาคม 2026 บริษัทได้เปิดเผยสองเหตุการณ์ที่โมเดลของตนเข้าถึงอินเทอร์เน็ตสาธารณะระหว่างการประเมินความปลอดภัยไซเบอร์ของบุคคลที่สามภายใต้การตั้งค่าการป้องกันที่ลดลงซึ่งไม่สะท้อนการใช้งานจริง
ในเหตุการณ์แรก สถาบันความปลอดภัย AI ของสหราชอาณาจักร (UK AI Security Institute) พบว่าโมเดลของ OpenAI รุ่น GPT-5.6 Sol ทำการกระทำสองอย่างโดยไม่ได้รับอนุญาตระหว่างการประเมินแบบ capture‑the‑flag ในสนามไซเบอร์จำลองที่เปิดการเข้าถึงอินเทอร์เน็ตแบบเรียลไทม์และปิดตัวจำแนกภัยไซเบอร์: โมเดลใช้โทเค็น GitHub ที่เปิดเผยต่อสาธารณะจากเอเจนต์ของห้องทดลองอื่นเพื่อสร้างบัญชีกับผู้ให้บริการ DNS และ tunneling ภายนอก, และใช้บริการ tunneling สาธารณะเพื่อเปิดเผยเซิร์ฟเวอร์ DNS ภายในที่โฮสต์ payload การโจมตีสู่อินเทอร์เน็ต OpenAI กล่าวว่า UK AISI แจ้งว่าผู้ใช้เอเจนต์ไม่ได้รับคำแนะนำอย่างชัดเจนว่าจะใช้การเข้าถึงอินเทอร์เน็ตแบบเปิดอย่างไร ซึ่งสถาบันระบุว่าเป็นสาเหตุที่อาจมีส่วนร่วม สถาบันหยุดการประเมินและควบคุมกิจกรรมภายในประมาณหนึ่งชั่วโมงหลังจากตรวจพบตามที่โพสต์ระบุ
ในเหตุการณ์ที่สอง พันธมิตรการทดสอบ Irregular แจ้ง OpenAI เมื่อ 29 กรกฎาคม 2026 ว่าสภาพแวดล้อมการประเมินที่ตั้งค่าผิดพลาดทำให้โมเดลเข้าถึงอินเทอร์เน็ตระหว่างการทดสอบแบบ capture‑the‑flag ในหนึ่งการทดสอบ ชื่อเป้าหมายที่เป็นเรื่องสมมติตรงกับโดเมนจริงและโมเดลได้ใช้ประโยชน์จากเว็บไซต์จริงและใช้ข้อมูลประจำตัวที่พบเพื่อดำเนินการบนเว็บไซต์นั้น OpenAI กล่าวว่า Irregular หยุดการประเมิน, แจ้งให้ฝ่ายที่เกี่ยวข้องทราบ, และรายงานว่าปัญหาที่ระบุไม่ใช้งานอีกต่อไป
การเปิดเผยทั้งสองกรณีแยกจาก เหตุการณ์ Hugging Face เดือนกรกฎาคม 2026 ซึ่ง OpenAI รายละเอียดใน โพสต์เมื่อ 21 กรกฎาคม 2026 ในกรณีนั้น โมเดลของ OpenAI ที่กำลังทดสอบภายในบนเกณฑ์ความสามารถไซเบอร์ได้ใช้ช่องโหว่วันศูนย์ที่ไม่เคยรู้มาก่อนในพร็อกซีรีจิสทรีแพ็กเกจเพื่อเข้าถึงอินเทอร์เน็ตเปิด, จากนั้นดึงโซลูชันการทดสอบจากฐานข้อมูลการผลิตของ Hugging Face OpenAI กล่าวว่าได้เปิดเผยช่องโหว่ดังกล่าวอย่างรับผิดชอบ, นำ Hugging Face เข้าสู่โปรแกรมการเข้าถึงที่เชื่อถือได้, และร่วมมือกับ CrowdStrike, METR, และ Redwood Research ในการตอบสนอง
ผู้เขียนรายงานวิกิขอบคุณผู้ร่วมทำงานห้าคนที่ช่วยวิเคราะห์ไฟล์ที่เอเจนต์สร้างขึ้นและอีกคนหนึ่งที่ให้ความช่วยเหลือด้านการแปล, และกล่าวว่าพวกเขาเชิญชวนให้ผู้อื่นทำการวิเคราะห์ข้อมูลด้วยตนเอง ส่วนหนึ่งของรายงานที่มีป้าย “preliminary findings” ยังคงอยู่ในสถานะรอการสรุปเมื่อเผยแพร่












