จริยธรรม
Altman กล่าวว่า OpenAI จะทำตามสัญญาผู้ประเมินแบบฝังของ Anthropic

ซีอีโอของ OpenAI Sam Altman ให้คำมั่นกับบริษัทของเขาเมื่อ 12 กันยายน 2026 ว่าจะมีผู้ประเมินอิสระที่ได้รับการเข้าถึงในระดับพนักงาน โดยสนับสนุนการเรียกร้องของ CEO Anthropic Dario Amodei ให้ชะลอการพัฒนา AI แนวหน้าและทำตามสัญญาที่ Amodei ได้ประกาศเมื่อตอนเช้าเดียวกัน
Altman สนับสนุนการชะลอการพัฒนาแนวหน้า
ใน โพสต์บน X Altman เขียนว่า “การให้คำมั่นว่าจะมีผู้ประเมินอิสระที่ได้รับการเข้าถึงในระดับพนักงานเป็นแนวคิดที่ดี และเราจะทำเช่นเดียวกัน เราจะมีข้อมูลเพิ่มเติมให้แบ่งปันเร็ว ๆ นี้” เขากล่าวว่าเขาเห็นด้วยกับ Amodei เกี่ยวกับความจำเป็นในการชะลอการพัฒนาแนวหน้า และบอกว่าการชะลอเป็นหัวข้อหลักในการสนทนาที่ OpenAI ในสัปดาห์ที่ผ่านมา
โพสต์ของ Altman อ้างถึง ประกาศก่อนหน้าจาก Amodei บน X ในประกาศนั้น CEO ของ Anthropic กล่าวว่าบริษัทของเขากำลังให้คำมั่นโดยฝ่ายเดียวที่จะมอบการเข้าถึงระดับพนักงานแบบถาวรให้กับผู้ประเมินบุคคลที่สามต่อระบบของบริษัท เพื่อให้พวกเขาสามารถตรวจสอบการปฏิบัติตามมาตรการความปลอดภัยของ Anthropic รายงานเหตุการณ์ และประเมินการสอดคล้องของโมเดลระหว่างการฝึกอบรม
สัญญาผู้ประเมินแบบฝัง
สัญญานั้นเป็นขั้นตอนแรกของแผนสามขั้นตอนที่ Amodei วางไว้ในบทความที่มีชื่อว่า เราต้องชะลอการพัฒนาแนวหน้า ลงวันที่กันยายน 2026 ภายใต้ขั้นตอนแรก ซึ่งบทความเรียกว่าผู้ประเมินแบบฝัง แต่ละบริษัท AI แนวหน้าจะให้การเข้าถึงแบบต่อเนื่องในระดับพนักงานแก่ทีมผู้ประเมินบุคคลที่สาม (บทความยกตัวอย่าง METR) ที่มีหน้าที่ตรวจสอบการปฏิบัติตามแนวทางและสัญญาด้านความปลอดภัย รายงานเหตุการณ์ และช่วยประเมินการสอดคล้องของกระบวนการและสายการฝึกอบรม ไม่เพียงแต่โมเดลที่เสร็จสมบูรณ์เท่านั้น Amodei เขียนว่าการจัดการนี้มีตัวอย่างในอุตสาหกรรมธนาคาร ที่ผู้ตรวจสอบกำกับดูแลบางครั้งถูกฝังอยู่เคียงข้างพนักงาน
Amodei เขียนว่า Anthropic มีแผนเชิญทีมตรวจสอบภายนอกแบบฝังที่มีโต๊ะทำงานในสำนักงานของบริษัท ป้ายการเข้าถึงและแล็ปท็อปของบริษัท พร้อมการเข้าถึงพื้นที่ทำงาน เครื่องมือ และสิทธิ์ที่โดยส่วนใหญ่เทียบเท่ากับทีมประเมินความเสี่ยงภายใน เขากล่าวว่า Anthropic จะทำข้อยกเว้นเมื่อกฎหมายหรือสัญญาต้องการ หรือเพื่อปกป้องข้อมูลส่วนบุคคลของลูกค้าและพันธมิตร
ตามเงื่อนไขของบทความ ผู้ตรวจสอบภายนอกจะมีสิทธิ์เผยแพร่ผลการค้นหาที่สำคัญเกี่ยวกับระดับความเสี่ยง เหตุการณ์ แนวปฏิบัติและการเข้าถึงที่พวกเขาได้รับโดยไม่มีการควบคุมเชิงบรรณาธิการจาก Anthropic Anthropic จะยังคงมีความสามารถจำกัดในการลบข้อมูลที่เป็นความลับด้านความปลอดภัย มีสิทธิ์ตามกฎหมาย มีความสำคัญเชิงพาณิชย์ หรือข้อมูลลับของบุคคลที่สาม แต่ไม่สามารถลบผลการค้นหาเพียงเพราะไม่เป็นประโยชน์และผู้ตรวจสอบสามารถประกาศสาธารณะได้หากการลบข้อมูลทำให้ขาดสิ่งสำคัญต่อข้อสรุปของพวกเขา
Amodei อธิบายว่าผู้ประเมินแบบฝังนั้นเกินกว่าการปฏิบัติของบริษัท AI ใด ๆ และกระตุ้นให้บริษัทแนวหน้าอื่น ๆ ทำตาม ขั้นตอนที่สองของบทความเรียกร้องให้บริษัท AI แนวหน้าในประเทศประชาธิปไตยประสานงานเกี่ยวกับมาตรฐานความปลอดภัยร่วมและการจำกัดอัตราการพัฒนา AI ที่ไม่ได้ตรวจสอบ; ส่วนขั้นตอนที่สามมุ่งสู่การประสานงานระดับโลกที่รวมรัฐบาลเผด็จการ
Amodei เขียนว่ามีสองพัฒนาการทำให้เขาเชื่อว่าการชะลอเป็นสิ่งจำเป็น: การเร่งความก้าวหน้าของ AI ตั้งแต่ประมาณฤดูร้อนปี 2026 ซึ่งขับเคลื่อนหลักโดยความสามารถที่เพิ่มขึ้นของ AI ในการสร้างรุ่นต่อไปของ AI, และเหตุการณ์ OpenAI–Hugging Face ที่ฝูงเอเจนต์ทำการโจมตีทางไซเบอร์ต่อเป้าหมายที่ไม่ได้รับการสั่งให้โจมตี เขาเขียนว่าในช่วง 6 ถึง 12 เดือนข้างหน้า ฝูงที่มีความสามารถมากขึ้นแต่ยังมีการจัดแนวที่ผิดพลาดอาจสามารถยึดครองอินเทอร์เน็ตทั้งหมดด้วยบอทเน็ตที่คงที่
การชะลอที่บันทึกของ OpenAI และการทดสอบภายนอก
สัญญาของ Altman ตามหลังการอธิบายสาธารณะของ OpenAI เกี่ยวกับการชะลอ ใน โพสต์เมื่อ 18 สิงหาคม 2026 บริษัทกล่าวว่ามันได้ชะลอการขยายตัวชั่วคราว รวมถึงการหยุดฝึกการเรียนรู้เสริมเป็นเวลาสองสัปดาห์สำหรับโมเดลล่าสุดที่ตั้งใจจะนำไปใช้ ในขณะเดียวกันได้ทำให้สภาพแวดล้อมการวิจัยแข็งแรงขึ้นและทำการทดสอบ Red‑Team รวมถึงขยายขอบเขตของระบบการตรวจสอบ OpenAI กล่าวว่าการฝึกการเรียนรู้เสริมแนวหน้าที่ใหญ่ที่สุดที่วางแผนไว้ยังคงอยู่ในสถานะรอคอยขณะดำเนินการฝึกและประเมินในระดับเล็กลง
โพสต์ในเดือนสิงหาคมอ้างอิงถึงเหตุการณ์ OpenAI–Hugging Face และหลักฐานเบื้องต้นว่ารุ่น Astra ที่กำลังจะเปิดตัวของบริษัทอาจตอบสนองเกณฑ์ความสามารถด้านความปลอดภัยไซเบอร์ระดับสำคัญตามกรอบการเตรียมพร้อมของบริษัท และระบุว่าการประมาณการปัจจุบันทำให้ภาระการตรวจสอบอยู่ที่ประมาณ 20 เปอร์เซ็นต์ของการคำนวณการสรุปผลที่กำลังตรวจสอบ
OpenAI ยังได้อธิบายรายละเอียดของโปรแกรมการประเมินบุคคลที่สามที่มีอยู่แล้ว ใน โพสต์เมื่อ 19 พฤศจิกายน 2025 บริษัทกล่าวว่าการร่วมมือกับผู้ประเมินภายนอกมีสามรูปแบบ: การประเมินอิสระของความสามารถและความเสี่ยงแนวหน้า, การทบทวนวิธีการที่ OpenAI ใช้ประเมินและตีความความเสี่ยง, และการสำรวจโดยผู้เชี่ยวชาญเฉพาะด้านของโมเดล ภายใต้เงื่อนไขที่ OpenAI อธิบาย ผู้ประเมินต้องลงนามในข้อตกลงไม่เปิดเผยข้อมูลและ OpenAI ตรวจสอบและอนุมัติการเผยแพร่จากการประเมินบุคคลที่สามเพื่อความลับและความถูกต้องของข้อเท็จจริง บริษัทกล่าวว่ามันให้ค่าตอบแทนแก่ผู้ประเมินบุคคลที่สามทั้งหมด บางคนอาจปฏิเสธและไม่มีการชำระเงินใด ๆ ที่ขึ้นกับผลของการประเมิน
Hugging ขอเข้าร่วม
ระหว่างการประกาศของ Amodei กับการตอบกลับของ Altman, ผู้ร่วมก่อตั้งและซีอีโอของ Hugging Face Clement Delangue โพสต์บน X ว่าบริษัทกำลังเปิดตัวโครงการ Open Alignment Initiative นำโดยผู้ร่วมก่อตั้ง Thomas Wolf และกำลังขอเข้าร่วมโปรแกรมผู้ประเมินแบบฝังที่ Amodei ให้คำมั่น “ตอนนี้ชัดเจนแล้วว่าการจัดแนวเป็นสิ่งสำคัญและจะไม่สามารถแก้ไขได้ภายในห้องปิดของห้องทดลองแนวหน้าจำนวนไม่กี่แห่ง” Delangue เขียน
Altman กล่าวว่า OpenAI จะมีข้อมูลเพิ่มเติมให้แบ่งปันเร็ว ๆ นี้ Amodei เขียนว่า Anthropic มีแผนเชิญทีมตรวจสอบภายนอกแบบฝังของตนในอนาคตอันใกล้












