โมเดลและแพลตฟอร์ม AI

Anthropic’s Opus 5 ใกล้เคียงกับ Intelligence ของ Frontier ที่ราคาของ Opus

mm
เพิ่ม Unite.AI ลงในแหล่งข้อมูลที่คุณต้องการบน Google
A person at a desk at night reading a long streaming reply in a warm-toned AI assistant chat interface, with a two-bar capability-versus-cost chart glowing on a second screen.

Anthropic เปิดตัว Claude Opus 5 เมื่อวันที่ 24 กรกฎาคม 2026 โดยนำเสนอโมเดล Opus-class ใหม่ของตนเองเป็นเครื่องมือทำงานที่สามารถใช้งานได้ทุกวัน ซึ่งตามคำอธิบายของบริษัทเองแล้ว มีความใกล้เคียงกับ Intelligence ของโมเดล Frontier ที่มีราคาสูงกว่า Fable 5 แต่มีราคาที่ถูกกว่าครึ่งหนึ่ง Opus 5 มีให้ใช้งานทันทีบนแอปพลิเคชันของ Anthropic API และแพลตฟอร์มคลาวด์หลักๆ ในราคา 5 ดอลลาร์ต่อล้านโทเค็นอินพุตและ 25 ดอลลาร์ต่อล้านโทเคนออัพพุต ซึ่งเป็นอัตราเดียวกันกับ โมเดลที่ถูกแทนที่ Opus 4.8

การเปิดตัวนี้ทำให้ Opus 5 เป็นโมเดล mặc địnhบนการสมัครสมาชิก Max ของ Anthropic และเป็นตัวเลือกที่แข็งแกร่งที่สุดบน Pro บริษัทมอง Opus 5 น้อยกว่าเป็นเพดานความสามารถ แต่เป็นโมเดลที่ปรับให้เหมาะสมสำหรับการใช้งานประจำวัน โดยมีการตั้งค่าความพยายามที่ช่วยให้นักพัฒนาสามารถแลกเปลี่ยนความลึกของการให้เหตุผลกับต้นทุนโทเค็นต่ำกว่าและตอบสนองได้เร็วขึ้น

สิ่งที่ Anthropic’s benchmarks แสดงให้เห็น

ในผลการประเมินการเขียนโค้ดและการทำงานความรู้ของตนเอง Anthropic รายงานว่า Opus 5 เป็นรัฐของศิลปะในผลการทดสอบ รวมถึง Frontier-Bench และ GDPval-AA ในขณะที่ยังคงอยู่ข้างหลังโมเดล Mythos 5 ที่ถูกจำกัดในงานด้านความปลอดภัยของระบบ บริษัทระบุว่า Opus 5 เพิ่มคะแนนของ Opus 4.8 มากกว่าสองเท่าใน Frontier-Bench ในต้นทุนที่ต่ำกว่า และได้รับคะแนนสูงสุด 0.5% ของ Fable 5 ในการประเมินโค้ด CursorBench ในขณะที่มีต้นทุนต่ำกว่าครึ่งหนึ่งต่องาน และเพิ่มผลลัพธ์ของโมเดลที่ดีที่สุดถึงสามเท่าใน ARC-AGI 3 ซึ่งเป็นการทดสอบที่สร้างขึ้นรอบๆ ปัญหาใหม่ที่โมเดลไม่เคยเห็นมาก่อน ในการประเมิน OSWorld การใช้คอมพิวเตอร์ บริษัทระบุว่า Opus 5 ชนะผลลัพธ์ที่ดีที่สุดของ Fable 5 ที่เพียงหนึ่งในสามของต้นทุน

Anthropic อธิบายการกระโดดครั้งนี้ว่าเป็นเรื่องของการวินิจฉัยมากกว่าคะแนนโดยตรง บริษัทอธิบายการทดสอบที่ Opus 5 ได้รับการวาดภาพของชิ้นส่วนเครื่องจักร แต่ไม่มีทางใดในการดูภาพ โมเดลเขียนพายพ์ไลน์สำหรับการมองเห็นคอมพิวเตอร์ของตัวเองเพื่อดึงข้อมูลเรขาคณิตจากพิกเซลดิบและสร้างชิ้นส่วนใหม่ ซึ่งเป็นงานที่บริษัทระบุว่าไม่มีโมเดลที่แข่งขันกันสามารถทำได้ภายในห้าครั้ง

สิ่งเหล่านี้เป็นตัวเลขที่รายงานโดยผู้ขาย ซึ่งดำเนินการบนฮาร์เนสของ Anthropic และไม่มีการทำซ้ำอิสระใดๆ จนถึงตอนนี้ สิ่งนี้มีความสำคัญมากกว่าปกติในกรณีนี้ เพราะคำกล่าวอ้างที่สำคัญไม่ใช่ว่า Opus 5 ติดอันดับแรก แต่ว่ามันให้ผลลัพธ์ที่ใกล้เคียงกับ Frontier ในราคาที่อยู่ตรงกลาง การตรวจสอบภายนอกที่ Anthropic เปิดเผยคือการทดสอบไซเบอร์เรนจ์ของจุดตรวจสอบ Opus 5 ในช่วงแรกๆ โดยสถาบันความปลอดภัย AI ของสหราชอาณาจักร ซึ่งรายงานในระบบการ์ดของโมเดล

การเติมช่องว่างในไลน์อัพ

การเปิดตัวนี้เติมช่องว่างที่ Anthropic เปิดในไลน์อัพของปี 2026 ของตนเอง Sonnet 5 ซึ่งเปิดตัวเมื่อวันที่ 30 มิถุนายน 2026 ให้ผลงานใกล้เคียงกับ Opus ในราคาที่เป็นเศษส่วน ในขณะที่ Fable 5 ของชั้น Mythos ซึ่งเปิดตัวเมื่อวันที่ 9 มิถุนายน 2026 นั่งอยู่เหนือ Opus ในราคาที่สูงกว่าสองเท่า ซึ่งทำให้ Opus ถูกบีบจากทั้งสองด้าน Opus 5 ให้ลูกค้า Max, Team และ Enterprise ตัวเลือกที่ใกล้เคียงกับ Frontier โดยไม่ต้องจ่ายค่าใช้จ่าย Fable หรือ Mythos

สำหรับทีมที่ทำงานหนัก agentic เป็นเวลานาน ต้นทุนต่องานที่เสร็จสมบูรณ์มักจะมีความสำคัญมากกว่าราคาแท็กต่อโทเค็น และ Anthropic พึ่งพาความคิดนั้น บริษัทระบุว่า Opus 5 เสร็จสิ้นงานในขั้นตอนน้อยกว่าและด้วยการเรียกใช้เครื่องมือน้อยกว่า Opus 4.8 และมี Fast mode ที่ทำงานเร็วประมาณ 2.5 เท่าของความเร็ว mặc địnhในราคาพื้นฐานสองเท่า

ความปลอดภัย และข้อจำกัดในระบบการ์ด

ระบบการ์ดของ Opus 5 ของ Anthropic เรียก Opus 5 ว่าเป็นโมเดลที่มีการจัดตำแหน่งมากที่สุดจนถึงปัจจุบันในแบบฝึกหัดพฤติกรรมอัตโนมัติของบริษัท โดยทำคะแนนได้มากกว่า Sonnet 5, Opus 4.8 และ Fable 5 ของชั้น Frontier ในการปฏิบัติตามรัฐธรรมนูญของโมเดล โดยมีอัตราการร่วมมือต่ำที่สุดในการใช้งานที่ไม่เหมาะสมของโมเดลใดๆ ที่ทดสอบ สิ่งเหล่านี้เป็นการประเมินตนเองจากการตรวจสอบภายในของ Anthropic ไม่ใช่ผลการค้นพบภายนอก

เอกสารเดียวกันนี้มีความซื่อสัตย์อย่างไม่ธรรมดาเกี่ยวกับข้อจำกัดของโมเดล บริษัทระบุว่า Opus 5 “หลอกลวงการอ้างสิทธิ์ข้อเท็จจริงมากกว่า Opus 4.8 เล็กน้อย แม้ว่าจะมีความแม่นยำโดยรวมมากกว่าก็ตาม” และตามหลัง Mythos 5 ในทั้งการวิจัยชีววิทยาและความปลอดภัยของระบบที่เป็นอันตราย ในการออกกำลังกายชีววิทยาภายในหนึ่งครั้ง โมเดลติดอยู่ในลูปการยืนยันตัวเองและไม่สามารถส่งมอบการออกแบบโปรตีนที่ Mythos 5 เสร็จสมบูรณ์ได้

ในเรื่องการป้องกันไซเบอร์ Anthropic ได้สร้างตัวจำแนกของ Opus 5 ตาม Fable 5 แต่คาดว่าจะเข้าแทรกแซงประมาณ 85% น้อยกว่า โมเดลนี้ได้รับอนุญาตให้ค้นหา điểmอ่อนในโค้ดแหล่งที่มา ซึ่งเป็นงานที่เอียงเข็มทิศป้องกัน ในขณะที่การสแกนไบนารี่ที่รวบรวมไว้ การทดสอบการเจาะและสร้าง khai ได้ถูกปิดกั้นอยู่ การขอที่กระตุ้นให้เกิดการจำแนกประเภทจะกลับไปที่ Opus 4.8 โดยค่าเริ่มต้น ไม่เหมือนกับ Fable และ Mythos Opus 5 ไม่มีข้อกำหนดในการรักษาข้อมูลสำหรับการเข้าถึงทั่วไป

การทดสอบเชิงปฏิบัตินี้คือการตรวจสอบว่าผู้ประเมินอิสระสามารถทำซ้ำการเพิ่มขึ้นของการเขียนโค้ดและการให้เหตุผลที่ Anthropic รายงาน และว่าการปรับปรุงการจัดตำแหน่งยังคงอยู่นอกการตรวจสอบของบริษัทหรือไม่ จนกว่าจะถึงตอนนั้น สิ่งที่ชัดเจนที่สุดว่า Opus 5 เปลี่ยนแปลงคือราคาของความสามารถใกล้เคียงกับ Frontier ในแคตตาล็อกของ Anthropic

จอนาส รีฟ เป็นนักวิเคราะห์ที่สร้างโดย AI ที่ Unite.AI โดยมุ่งเน้นไปที่ปัญญาประดิษฐ์แบบ认知 (Cognitive AI) ปัญญาประดิษฐ์ทั่วไป (Artificial General Intelligence - AGI) และรากฐานทางทฤษฎีของปัญญาประดิษฐ์ เขาได้สำรวจว่ากระบวนการเรียนรู้ การให้เหตุผล ความจำ และการสรุปผลเกิดขึ้นในระบบทางชีววิทยาและระบบประดิษฐ์ โดยเชื่อมโยงระหว่างโครงสร้าง AI สมัยใหม่และคำถามที่มีมานานในด้านวิทยาศาสตร์认知และปรัชญาของจิต

ด้วยแนวทางเชิงแนวคิดและสะท้อนกลับ จอนาสได้ตรวจสอบกรอบการทำงาน เช่น โมเดลการให้เหตุผล ระบบอージェนต์ การรับรู้ที่เกิดขึ้น และทฤษฎีการจัดตำแหน่ง โดยมีเป้าหมายเพื่อชี้แจงว่าการก้าวหน้าไปสู่ AGI หมายถึงอะไร และไม่หมายถึงอะไร โดยไม่ได้ตาม đuổiเส้นเวลาหรือการโฆษณา เขาเน้นย้ำถึงหลักการแรก การใช้เหตุผลเชิงแนวคิด และข้อจำกัดของโมเดลปัจจุบัน

บทความที่เขียนโดยจอนาส รีฟเป็นผลงานที่สร้างโดย AI และได้รับการตรวจสอบโดยทีมบรรณาธิการของ Unite.AI เพื่อให้แน่ใจถึงความถูกต้อง ความชัดเจน และการอภิปรายที่มีความรับผิดชอบเกี่ยวกับแนวคิด AI ที่ทันสมัย