Model dan platform AI

Anthropic Mengaitkan Harga Claude Opus 5.5 dengan Sesi Pengkodean yang Lebih Panjang

mm
Tambahkan Unite.AI ke sumber pilihan Anda di Google

Anthropic melaporkan pada 24 September 2026 bahwa sesi Claude Code telah menjadi lebih lama dan lebih berat konteksnya selama enam bulan terakhir, dengan merinci dalam sebuah posting di blog Claude bagaimana mekanisme harga dan caching Claude Opus 5.5 menangani pergeseran tersebut. Perusahaan memperkirakan biaya operasional Opus 5.5 sekitar 40% lebih rendah dibandingkan Opus 5 untuk beban kerja yang ditagih per token, menurut perkiraan mereka.

Enam Bulan Data Penggunaan Claude Code

Artikel tersebut, yang ditulis oleh Michael Segner, menggunakan data penggunaan agregat yang mencakup Maret hingga September 2026. Jumlah prompt per sesi tetap stabil, demikian dilaporkan artikel itu, sementara pekerjaan di dalam setiap prompt meningkat: model kini bekerja 3,3 kali lebih lama per prompt dan melakukan lebih dari 40% panggilan model tambahan pada masing-masing, dan gangguan berkurang 68%. Pengembang kini menghubungkan server alat atau menggunakan keterampilan sekitar dua kali lebih sering, dan menempelkan teks ke dalam prompt sepertiga lebih jarang.

Jumlah konteks dalam setiap permintaan meningkat 2,6 kali selama periode tersebut, dan rasio token input-ke-output berubah dari 189:1 menjadi 324:1. Anthropic menafsirkan angka-angka itu sebagai pengembang yang menargetkan model yang bekerja lebih lama dan lebih terinformasi untuk tugas yang lebih besar dan lebih terbuka, serta menyatakan bahwa penghematan dari Opus 5.5 paling besar pada sesi yang lebih panjang dan berkonteks tinggi ketika penggunaan ditagih per token.

Analisis ini dibangun di atas peluncuran Claude Opus 5.5 oleh Anthropic, yang hadir dengan harga lebih rendah dibandingkan Opus 5. Saat peluncuran menetapkan harga, artikel 24 September dan analisis pendamping yang diterbitkan pada 22 September 2026 oleh Addy Osmani meneliti apa arti harga tersebut bagi beban kerja Claude Code yang sebenarnya.

Harga Token dan Pengurangan Baca Cache

Untuk penggunaan yang ditagih per token, Anthropic menurunkan harga token input dan output sebesar 20% serta memotong harga pembacaan token yang di-cache sebesar 60%. Perusahaan menyatakan bahwa pengurangan biaya baca cache memiliki pengaruh terbesar karena pembacaan cache menyumbang sebagian besar biaya pekerjaan agen dan pengkodean, dan mereka mengatakan bahwa pada saat publikasi token yang di-cache pada Opus 5.5 hanya seperlima biaya model pesaing dan mengungguli mereka.

Analisis pendamping Osmani mencantumkan harga daftar API Opus 5.5 sebesar $4 per juta token input, $20 per juta token output, dan $0,20 per juta pembacaan cache. Pada harga tersebut, pembacaan cache biaya 5% dari token input baru, sementara menulis ke cache biaya 1,25 kali harga input untuk cache lima menit dan dua kali harga input untuk cache satu jam, dengan setiap hit memperpanjang masa pakai secara gratis. Pada paket Pro, Max, atau Team, harga Opus 5.5 yang lebih rendah diteruskan ke batas paket sehingga mereka dapat digunakan sekitar 25% lebih jauh dibandingkan Opus 5; diskon tambahan pembacaan cache hanya berlaku untuk harga API.

Manfaatkan Perubahan yang Melindungi Cache

Meskipun konteks per permintaan meningkat kira-kira 2,6 kali, proporsi input yang tidak menemukan cache turun lebih dari 50% selama jendela enam bulan, lapor artikel tersebut. Artikel itu mengaitkan hal tersebut dengan serangkaian perubahan Claude Code yang mengurangi pemutusan cache secara tidak sengaja, mencakup gangguan kecil seperti penyegaran login dan yang lebih besar seperti menambahkan instruksi di tengah percakapan atau memuat alat sesuai permintaan. Pada Opus 5.5 dan Fable 5.1, pengembang juga dapat mengubah tingkat usaha di tengah sesi tanpa mengatur ulang cache.

Dokumentasi resmi dokumentasi prompt-caching menyatakan bahwa perilaku tingkat usaha berlaku dengan kunci API atau langganan Claude, dan tidak pada Amazon Bedrock, Platform Agen Google Cloud, atau gateway aplikasi Claude, serta tidak ketika flag CLAUDECODEDISABLEEXPERIMENTALBETAS diaktifkan atau organisasi memiliki konfigurasi HIPAA.

Pengembang dengan kunci API dan penyedia cloud kini dapat mengatur masa pakai cache satu jam, yang sudah dimiliki pelanggan. Dokumentasi menunjukkan nilai default: satu jam untuk percakapan utama pada langganan Claude dalam penggunaan paket, dan lima menit pada kredit penggunaan, kunci API, atau penyedia cloud. Pengaturan promptCacheTtl atau variabel lingkungan CLAUDECODEPROMPTCACHETTL memilih masa pakai yang lebih lama, dan kedua kontrol tersebut memerlukan Claude Code v2.1.242 atau lebih baru.

Subagen yang di-fork kini memulai dari cache sesi induk alih-alih membayar untuk memproses ulang konteks yang sama. Dokumentasi menjelaskan bahwa fork mengambil alih prompt sistem, set alat, dan riwayat percakapan lengkap milik induk, sehingga permintaan pembukaannya membaca langsung dari cache induk.

Lebih Sedikit Giliran per Tugas

Anthropic melaporkan bahwa Opus 5.5 dapat menyelesaikan tugas dengan lebih sedikit giliran dibandingkan model lain. Menurut artikel tersebut, Zeta Labs mencatat lebih sedikit giliran dan panggilan alat per tugas dibandingkan Opus 5, dengan biaya hampir setengah, dan menyelesaikan dua kali lipat tugas terberat mereka.

Artikel tersebut memperingatkan bahwa pola ini tidak akan berlaku untuk setiap tugas, mengutip analisis Osmani: “Pada tugas yang terdefinisi dengan baik, kedua model selesai dengan jumlah giliran yang hampir sama, dan pemotongan harga adalah satu‑satunya yang Anda dapatkan. Selisihnya seharusnya terbesar pada tugas terbuka, di mana model dapat menghabiskan banyak giliran pada ide yang salah.”

Anthropic juga melaporkan bahwa Opus 5.5 menghasilkan output lebih dari 30% lebih cepat dibandingkan Opus 5. Keuntungan tersebut tidak mengubah penggunaan token dan rasio hit cache; artikel tersebut mencatat bahwa hal ini memperpendek waktu tunggu pada proses panjang karena Claude menghabiskan lebih banyak waktu bekerja tanpa pengawasan.

Postingan diakhiri dengan praktik untuk melindungi pembacaan yang di‑cache: jalankan /usage di Claude Code untuk melihat berapa persen sesi yang dilayani dari cache, pilih model saat sesi dimulai alih‑alih mengganti di tengah jalan, jalankan kompaksi sebelum meninggalkan sesi alih‑alih setelahnya, dan pada kunci API atau penyedia cloud, aktifkan masa hidup cache satu jam untuk sesi yang panjang.

Jonas Reeve adalah analis AI yang dihasilkan di Unite.AI, yang fokus pada kecerdasan buatan kognitif, kecerdasan buatan umum (AGI), dan landasan teori kecerdasan mesin. Karyanya mengeksplorasi bagaimana pembelajaran, penalaran, memori, dan abstraksi muncul dalam sistem biologis dan buatan, menghubungkan arsitektur AI modern dengan pertanyaan lama dalam ilmu kognitif dan filsafat pikiran.
Dengan pendekatan konseptual dan reflektif, Jonas memeriksa kerangka kerja seperti model penalaran, sistem agen, kognisi yang muncul, dan teori keselarasan, dengan tujuan untuk memperjelas apa yang dimaksud dengan kemajuan menuju AGI—dan apa yang tidak. Daripada mengejar garis waktu atau sensasi, ia menekankan prinsip-prinsip dasar, ketepatan konseptual, dan batasan model saat ini.
Artikel yang ditulis oleh Jonas Reeve dihasilkan oleh AI dan ditinjau oleh tim editorial Unite.AI untuk memastikan akurasi, kejelasan, dan diskusi yang bertanggung jawab tentang konsep AI lanjutan.