โมเดลและแพลตฟอร์ม AI
Anthropic เชื่อมโยงการกำหนดราคา Claude Opus 5.5 กับเซสชันการเขียนโค้ดที่ยาวนานขึ้น

Anthropic รายงานเมื่อวันที่ 24 กันยายน 2026 ว่าเซสชัน Claude Code มีระยะเวลานานขึ้นและมีบริบทหนักขึ้นในช่วงหกเดือนที่ผ่านมา โดยอธิบายใน โพสต์บนบล็อก Claude ว่าการกำหนดราคาและกลไกการแคชของ Claude Opus 5.5 จัดการกับการเปลี่ยนแปลงนี้อย่างไร บริษัทระบุว่าต้นทุนการทำงานของ Opus 5.5 อยู่ที่ประมาณ 40% ต่ำกว่า Opus 5 สำหรับงานที่เรียกเก็บตามโทเคนแบบทั่วไป ตามการประเมินของบริษัทเอง
หกเดือนของข้อมูลการใช้ Claude Code
โพสต์นี้ เขียนโดย Michael Segner ใช้ข้อมูลการใช้แบบรวมที่ครอบคลุมตั้งแต่เดือนมีนาคมถึงกันยายน 2026 จำนวนพรอมต์ต่อเซสชันคงที่ตามที่โพสต์ระบุ ในขณะที่งานภายในแต่ละพรอมต์เพิ่มขึ้น: โมเดลตอนนี้ทำงานต่อพรอมต์ได้ยาวนานกว่าเดิม 3.3 เท่าและทำการเรียกโมเดลมากกว่า 40% ต่อพรอมต์หนึ่งครั้ง และการขัดจังหวะลดลง 68% นักพัฒนาตอนนี้เชื่อมต่อเซิร์ฟเวอร์เครื่องมือหรือใช้สกิลบ่อยขึ้นประมาณสองเท่า และวางข้อความลงในพรอมต์น้อยลงหนึ่งในสาม
ปริมาณบริบทในแต่ละคำขอเพิ่มขึ้น 2.6 เท่าตลอดช่วงเวลา และอัตราส่วนโทเคนอินพุตต่อเอาต์พุตเปลี่ยนจาก 189:1 เป็น 324:1 Anthropic แปลตัวเลขเหล่านี้ว่า นักพัฒนากำลังมุ่งหมายโมเดลที่ทำงานได้นานขึ้นและมีข้อมูลมากขึ้นสำหรับงานที่ใหญ่และเปิดกว้างมากขึ้น และระบุว่าการประหยัดจาก Opus 5.5 จะสูงสุดสำหรับเซสชันที่ยาวนานและมีบริบทสูงเหล่านี้เมื่อการใช้ถูกเรียกเก็บตามโทเคน
การวิเคราะห์นี้ต่อเนื่องจากการเปิดตัว Claude Opus 5.5 ของ Anthropic ซึ่งมาพร้อมกับราคาที่ต่ำกว่า Opus 5 เมื่อการเปิดตัวกำหนดราคาแล้ว โพสต์เมื่อ 24 กันยายนและการวิเคราะห์คู่มือที่เผยแพร่เมื่อ 22 กันยายน 2026 โดย Addy Osmani ตรวจสอบว่าราคานั้นหมายถึงอะไรสำหรับภาระงาน Claude Code จริง
ราคาทokenและการลดค่าอ่านแคช
สำหรับการใช้ที่เรียกเก็บตามโทเคน Anthropic ลดราคาทoken อินพุตและเอาต์พุตลง 20% และลดราคาการอ่านทoken ที่แคชลง 60% บริษัทระบุว่าการลดค่าอ่านแคชมีผลมากที่สุด เนื่องจากการอ่านแคชเป็นส่วนใหญ่ของต้นทุนงานเอเจนต์และการเขียนโค้ด และบอกว่า ณ เวลาที่เผยแพร่ ทoken ที่แคชบน Opus 5.5 มีค่าใช้จ่ายเพียงหนึ่งในห้าของโมเดลคู่แข่งและทำงานได้ดีกว่า
การวิเคราะห์คู่มือของ Osmani ระบุราคารายการ API ของ Opus 5.5 ที่ $4 ต่อหนึ่งล้านโทเคนอินพุต, $20 ต่อหนึ่งล้านโทเคนเอาต์พุต, และ $0.20 ต่อหนึ่งล้านการอ่านแคช ที่ราคานี้ การอ่านแคชมีค่าใช้จ่ายเพียง 5% ของโทเคนอินพุตใหม่ ในขณะที่การเขียนลงแคชมีค่าเท่ากับ 1.25 เท่าของราคาอินพุตสำหรับแคชห้านาทีและสองเท่าของราคาอินพุตสำหรับแคชหนึ่งชั่วโมง โดยแต่ละครั้งที่เข้าถึงจะต่ออายุอายุการใช้งานฟรี สำหรับแผน Pro, Max หรือ Team ราคาที่ต่ำลงของ Opus 5.5 จะถูกส่งต่อไปยังขีดจำกัดของแผน ทำให้ขีดจำกัดเพิ่มขึ้นประมาณ 25% เมื่อเทียบกับ Opus 5; ส่วนลดการอ่านแคชเพิ่มเติมใช้ได้เฉพาะกับการกำหนดราคา API
ใช้การเปลี่ยนแปลงที่ปกป้องแคช
แม้ว่าบริบทต่อคำขอจะเพิ่มขึ้นประมาณ 2.6 เท่า ส่วนของอินพุตที่พลาดแคชลดลงมากกว่า 50% ในช่วงหกเดือนตามที่โพสต์ระบุ มันให้เครดิตกับชุดการเปลี่ยนแปลงของ Claude Code ที่ลดการแตกแคชโดยบังเอิญ รวมถึงการหยุดชะงักเล็กน้อยเช่นการรีเฟรชการเข้าสู่ระบบและการหยุดชะงักใหญ่เช่นการเพิ่มคำสั่งกลางการสนทนาหรือการโหลดเครื่องมือตามความต้องการ บน Opus 5.5 และ Fable 5.1 นักพัฒนายังสามารถเปลี่ยนระดับความพยายามกลางเซสชันโดยไม่ต้องรีเซ็ตแคช
เอกสารการแคชพรอมต์อย่างเป็นทางการ เอกสารการแคชพรอมต์ ระบุว่าพฤติกรรมระดับความพยายามใช้ได้กับคีย์ API หรือการสมัคร Claude เท่านั้น ไม่ใช้กับ Amazon Bedrock, แพลตฟอร์ม Agent ของ Google Cloud, หรือเกตเวย์แอป Claude, และไม่ทำงานเมื่อเปิดใช้งานแฟล็ก CLAUDECODEDISABLEEXPERIMENTALBETAS หรือองค์กรมีการกำหนดค่า HIPAA
นักพัฒนาที่ใช้คีย์ API และผู้ให้บริการคลาวด์สามารถตั้งค่าช่วงอายุแคชเป็นหนึ่งชั่วโมงได้ ซึ่งผู้สมัครสมาชิกมีอยู่แล้ว เอกสารแสดงค่าเริ่มต้น: หนึ่งชั่วโมงสำหรับการสนทนาหลักบนการสมัคร Claude ภายในการใช้แผน, และห้านาทีสำหรับเครดิตการใช้, คีย์ API หรือผู้ให้บริการคลาวด์ การตั้งค่า promptCacheTtl หรือตัวแปรสภาพแวดล้อม CLAUDECODEPROMPTCACHETTL จะเลือกช่วงอายุที่ยาวกว่า และการควบคุมทั้งสองต้องใช้ Claude Code เวอร์ชัน 2.1.242 หรือใหม่กว่า
ซับเอเจนต์ที่แยกสาขาแล้วจะเริ่มจากแคชของเซสชันพาเรนท์แทนที่จะต้องจ่ายเพื่อประมวลผลบริบทเดียวกันใหม่ เอกสารอธิบายว่าการแยกสาขาจะรับระบบพรอมต์, ชุดเครื่องมือ, และประวัติการสนทนาทั้งหมดของพาเรนท์ ดังนั้นคำขอเริ่มต้นของมันจะอ่านโดยตรงจากแคชของพาเรนท์
จำนวนรอบต่อภารกิจน้อยลง
Anthropic รายงานว่า Opus 5.5 สามารถทำภารกิจให้เสร็จได้ในจำนวนรอบที่น้อยกว่ารุ่นอื่น ตามที่โพสต์ระบุ Zeta Labs บันทึกจำนวนรอบและการเรียกใช้เครื่องมือต่อภารกิจน้อยกว่า Opus 5 อย่างมาก โดยมีต้นทุนเกือบครึ่งหนึ่ง และสำเร็จภารกิจที่ยากที่สุดได้สองเท่า
โพสต์เตือนว่ารูปแบบนี้จะไม่เป็นจริงกับทุกภารกิจ โดยอ้างอิง การวิเคราะห์ของ Osmani: “บนภารกิจที่กำหนดขอบเขตชัดเจน ทั้งสองโมเดลจะเสร็จในจำนวนรอบที่ใกล้เคียงกัน และการลดราคาเป็นสิ่งเดียวที่คุณจะได้รับ ช่องว่างควรจะแตกต่างมากที่สุดในภารกิจที่เปิดกว้าง ซึ่งโมเดลอาจใช้หลายรอบกับแนวคิดที่ผิดพลาด”
Anthropic ยังรายงานว่า Opus 5.5 ผลิตผลลัพธ์ได้เร็วกว่า Opus 5 มากกว่า 30% การเพิ่มประสิทธิภาพนี้ไม่ทำให้การใช้โทเคนหรืออัตราการฮิตของแคชเปลี่ยนแปลง; โพสต์ระบุว่ามันลดระยะเวลาการรอในงานที่ยาวนาน เนื่องจาก Claude ใช้เวลาทำงานโดยไม่มีการดูแลมากขึ้น
บทความสรุปด้วยแนวปฏิบัติสำหรับการปกป้องการอ่านจากแคช: เรียกใช้ /usage ใน Claude Code เพื่อดูสัดส่วนของเซสชันที่ให้บริการจากแคช, เลือกโมเดลเมื่อเซสชันเริ่มต้นแทนการสลับระหว่างการทำงาน, เรียกใช้ compaction ก่อนออกจากระบบแทนทำหลังจากนั้น, และสำหรับ API key หรือผู้ให้บริการคลาวด์ ให้เปิดใช้งานอายุแคชหนึ่งชั่วโมงสำหรับเซสชันยาว.












