โมเดลและแพลตฟอร์ม AI

Anthropic ปรับแต่ง Fable 5 เพื่อเพิ่มความปลอดภัยทางชีววิทยา ลดการปิดกั้นคำถาม 85%

mm
เพิ่ม Unite.AI ลงในแหล่งข้อมูลที่คุณต้องการบน Google

Anthropic ได้เผยแพร่การอัปเดตระบบความปลอดภัยทางชีววิทยาใน Claude Fable 5 เมื่อวันที่ 7 สิงหาคม 2026 โดยระบุว่าการอัปเดตนี้สามารถลดการปิดกั้นคำถามที่เกี่ยวข้องกับชีววิทยาได้ประมาณ 85% ในการทดสอบบนพื้นผิวผลิตภัณฑ์ของตน — การส่งต่อคำถามอัตโนมัติที่ส่งคำถามของผู้ใช้ไปยังโมเดลที่มีความสามารถน้อยกว่าเมื่อระบบตัดสินว่าคำถามนั้นเกี่ยวข้องกับพื้นที่ชีววิทยาที่ได้รับการคุ้มครอง

ใน การประกาศ ของ Anthropic ระบุว่าผู้ใช้ควรเห็นการปิดกั้นคำถามที่เกี่ยวข้องกับสุขภาพและคำถามทางการศึกษาน้อยลง เช่น การตีความผลการทดสอบในห้องปฏิบัติการ การทำความเข้าใจอาการ และการเรียนรู้ชีววิทยาในบริบททางการศึกษา และผู้เชี่ยวชาญด้านสุขภาพควรได้รับการสนับสนุนมากขึ้นในการทำงานทางคลินิก การลดการปิดกั้นคำถามที่เกี่ยวข้องกับชีววิทยาคาดว่าจะลดปริมาณการปิดกั้นทั้งหมดลงประมาณ 67% บน Claude.ai, 55% บน Cowork, 17% บน Claude Code และ 7% บนแพลตฟอร์ม Claude ตามที่ระบุในคำอธิบายตัวประกอบ

บริษัทได้ระบุอย่างชัดเจนว่าการอัปเดตนี้ไม่ได้เปิดโมเดลให้กับการวิจัยทางชีววิทยาทางอาชีพ Fable 5 ยังคงใช้โมเดล Claude Opus 5 สำหรับคำถามที่ Anthropic พิจารณาว่าเป็นคำถามที่มีการใช้งานทวีคูณ รวมถึงไวรัสวิทยา พิษวิทยา และการออกแบบโมเลกุล ซึ่งบริษัทระบุว่าทำให้โมเดล “ยังไม่เหมาะสำหรับการวิจัยทางชีววิทยาและพัฒนายา” Anthropic ระบุว่าพวกเขาตั้งใจที่จะปิดช่องว่างนี้ผ่านเส้นทางการเข้าถึงที่เชื่อถือได้ ไม่ใช่ผ่านคลาสสิฟายเออร์สาธารณะ

ระบบป้องกันที่ถูกสร้างขึ้นเพื่อป้องกันอะไร

สถาปัตยกรรมการป้องกันถูกสร้างขึ้นตั้งแต่การเปิดตัว Fable 5 เมื่อวันที่ 9 มิถุนายน 2026 Anthropic ได้เปิดตัวโมเดลพร้อมคลาสสิฟายเออร์ — ระบบ AI อัตโนมัติที่เล็กกว่าซึ่งกรองคำถาม — ที่ครอบคลุมด้านความมั่นคงทางไซเบอร์ ชีววิทยา และเคมี และการพยายามกลั่นกรอง เมื่อคลาสสิฟายเออร์ทำงาน คำถามจะถูกส่งไปยังโมเดล Opus ที่มีความสามารถมากที่สุดถัดไป ในการเปิดตัว Anthropic ระบุว่าพวกเขาได้ตั้งค่าระบบความปลอดภัยอย่างระมัดระวังและคาดว่าจะมีการปิดกั้นในน้อยกว่า 5% ของเซสชัน

การครอบคลุมด้านชีววิทยาคือสิ่งที่กว้างที่สุดในสามส่วน Anthropic อธิบายว่าเหตุผลที่ระบุไว้ในโพสต์การเปิดตัวและ การ์ดระบบ ของโมเดลคือว่าโมเดล Mythos สามารถทำงานได้ดีกว่าผู้เชี่ยวชาญในบางงานชีววิทยาที่ซับซ้อนและให้การสนับสนุนการทำงานในงานอื่น — ความสามารถที่บริษัทประเมินว่าสามารถให้การเพิ่มขึ้นอย่างมีนัยสำคัญต่อผู้กระทำที่มีเจตนาไม่ดี การ์ดระบบถือว่าโมเดลมีความสามารถ “CB-1” หมายความว่าสามารถช่วยเหลือผู้ที่มีพื้นฐานทางเทคนิคที่ดีในกระบวนการที่เกี่ยวข้องกับอาวุธที่ทราบ และตัดสินว่าไม่ข้ามขอบเขต “CB-2” ของการแทนที่ความเชี่ยวชาญระดับโลกที่หายากในการพัฒนาอาวุธชีวภาพใหม่ — การตัดสินที่การ์ดอธิบายว่าเป็น “ไม่ชัดเจน” มากกว่าสำหรับโมเดลก่อนหน้า

การอัปเดตในวันนี้อ้างอิงจาก รายงานการประเมินภัยคุกคามประจำปี 2026 ของชุมชนข่าวกรองสหรัฐฯ ซึ่งเตือนว่าการพัฒนาชีวภาพ รวมถึงชีววิทยาสังเคราะห์และการแก้ไขจีโนม “อาจนำไปสู่ภัยคุกคามชีวภาพใหม่” และชี้ว่าหลายประเทศอาจยังคงมีโปรแกรมอาวุธชีวภาพและเคมีที่เป็นอันตรายอยู่

สิ่งที่เปลี่ยนแปลงในคลาสสิฟายเออร์

ในช่วงหลายสัปดาห์ที่ผ่านมา Anthropic ได้เขียนคลาสสิฟายเออร์สำหรับชีววิทยาใหม่ — ชุดของกฎที่โมเดลการกรองใช้เพื่อแยกเนื้อหาที่ได้รับการคุ้มครองออกจากเนื้อหาที่อนุญาต — โดยการแกะรายละเอียดการใช้งานที่ไม่เป็นอันตรายมากขึ้น การขอคำแนะนำจากผู้เชี่ยวชาญภายในและภายนอก การฝึกอบรมคลาสสิฟายเออร์ใหม่ด้วยข้อมูลที่อัปเดต และการตรวจสอบว่ายังคงทำงานเมื่อมีเนื้อหาที่เป็นอันตรายและใช้งานทวีคูณ

แผนภาพของบริษัทที่แสดงการเปลี่ยนแปลงนี้แสดงให้เห็นว่าขอบเขตของคลาสสิฟายเออร์เปลี่ยนไปเพื่อรับคำถามที่ถูกจับก่อนหน้านี้ใน “ขอบเขตความปลอดภัย” — เนื้อหาที่ Anthropic ประเมินว่าน่าจะเป็นเนื้อหาที่ไม่เป็นอันตราย แต่ถูกปิดกั้นเพื่อความระมัดระวัง การเขียนของ Anthropic ในเรื่องเดียวกันในโดเมนความมั่นคงทางไซเบอร์ อธิบายถึงความตึงเครียดที่คล้ายกันระหว่างการครอบคลุมที่กว้างและความแข็งแกร่งของการป้องกัน — สิ่งที่ Unite.AI ได้กล่าวถึงเมื่อ โมเดล Claude ที่ไม่มีการป้องกันเหล่านี้เปลี่ยนมาตรฐานการโจมตีทางไซเบอร์เป็นการบุกรุกจริงสามครั้ง

การแลกเปลี่ยนที่ Anthropic จัดการอย่างเปิดเผย

การประกาศครั้งนี้เป็นเอกสารการกำกับดูแลเช่นเดียวกับบันทึกผลิตภัณฑ์ Anthropic เปิดตัว Fable 5 โดยมีการปิดกั้นคำถามเกี่ยวกับชีววิทยาส่วนใหญ่ ดูดซับผลลัพธ์เป็นเวลาหลายสัปดาห์ และตอนนี้เผยแพร่ผลลัพธ์ที่วัดได้ของการลดการปิดกั้น — รวมถึงการลดการปิดกั้นต่อพื้นผิว ซึ่งให้ฐานการวัดที่เป็นรูปธรรมสำหรับการแก้ไขครั้งถัดไป การจำกัดที่เหลืออยู่ที่ที่ที่บริษัทระบุว่ามีความเสี่ยงจริง: การวิจัยทางชีววิทยาที่ใช้งานทวีคูณสำหรับมืออาชีพยังคงอยู่หลังการปิดกั้นของ Opus 5 จนกว่าเส้นทางการเข้าถึงที่เชื่อถือได้ ซึ่ง Anthropic ได้พัฒนามาตั้งแต่การเปิดตัวในเดือนมิถุนายนสำหรับนักวิจัยชีววิทยาที่ได้รับการตรวจสอบ จะรับจราจรนั้น

บริษัทยอมรับว่าผลลัพธ์เท็จที่เหลืออยู่จะยังคงอยู่ภายในขอบเขตความปลอดภัยและระบุว่าการปรับปรุงการป้องกันยังคงดำเนินอยู่ สิ่งที่ได้เขียนไว้พร้อมกับการอัปเดตเมื่อวันที่ 7 สิงหาคมคือคำจำกัดความที่วัดได้ของความก้าวหน้า: อัตราการปิดกั้นที่จะถูกตัดสินจากนี้

มิรา เคลแลน เป็นนักเขียนคอลัมน์ AI ที่เชี่ยวชาญด้าน จริยธรรม AI การกำกับดูแล และการควบคุม ผลงานของเธอศึกษาว่าปัญญาประดิษฐ์เชื่อมโยงกับนโยบายสาธารณะ ค่านิยมของสังคม และความรับผิดชอบในระยะยาว โดยมุ่งเน้นไปที่นวัตกรรมที่รับผิดชอบ
เมื่อเข้าใกล้ประเด็นที่ซับซ้อนโดยใช้เลนส์เชิงตรรกะและปรัชญา มิรา วิเคราะห์ข้อบังคับ AI ที่เกิดขึ้นใหม่ แฟร์มเวิร์กจริยธรรม และรูปแบบการกำกับดูแลที่กำหนดอนาคตของระบบอัจฉริยะ เธอมุ่งหวังที่จะขยายช่องว่างระหว่างความก้าวหน้าทางเทคโนโลยีที่รวดเร็วและมาตรการรักษาความปลอดภัยที่จำเป็นเพื่อให้แน่ใจว่าระบบ AI ยังคงเป็นระบบที่โปร่งใส ยุติธรรม และสอดคล้องกับผลประโยชน์ของมนุษย์
บทความที่เขียนโดยมิรา เคลแลน ถูกสร้างขึ้นโดย AI และได้รับการตรวจสอบโดยทีมบรรณาธิการของ Unite.AI เพื่อให้แน่ใจถึงความถูกต้อง ความสมดุล และการปฏิบัติตามมาตรฐานการบรรณาธิการ