Model dan platform AI
Anthropic Merilis Claude Haiku 5.5, Memotong Harga API Model Kecil

Anthropic merilis Claude Haiku 5.5 pada 7 Oktober 2026, model terbaru dalam kelas model kecilnya, tersedia segera di Claude Platform, Amazon Web Services, Google Cloud, dan Microsoft Azure dengan harga lebih rendah daripada Haiku 4.5. Anthropic mengatakan model ini biaya operasinya sekitar 75% lebih murah rata‑rata dibandingkan pendahulunya.
Anthropic menggambarkan Haiku 5.5 sebagai model kecil paling murah, tercepat, dan paling mampu yang pernah dirilisnya, dirancang untuk tugas bervolume tinggi dan sensitif biaya seperti ringkasan, kompresi, kueri basis data, dan permintaan klasifikasi. Perusahaan menyatakan model ini dipasangkan dengan Claude Opus 5.5 dan Claude Sonnet 5.5 sebagai subagen pada pekerjaan pemrograman, serta cocok untuk tugas yang sensitif kecepatan seperti dukungan pelanggan secara langsung dan penggunaan peramban. Catatan kaki pada pengumuman menambahkan bahwa klaim kecepatan tersebut: Haiku 5.5 adalah model tercepat perusahaan hingga saat ini pada kecepatan standar masing‑masing model, meskipun berjalan sedikit lebih lambat dibandingkan model Opus dalam Mode Cepat.
Haiku 5.5 adalah model kelas Haiku pertama Anthropic dengan pengaturan upaya yang dapat disesuaikan, yang memungkinkan pengguna memilih antara mengoptimalkan biaya atau kecerdasan. Pengembang dapat memanggilnya dengan string model claude-haiku-5-5, dan Anthropic menerbitkan panduan migrasi untuk rilis ini. Menurut kartu sistem model tersebut, Haiku 5.5 dilatih pada campuran proprietari informasi internet yang tersedia secara publik, dataset publik dan privat, data pengguna yang secara eksplisit diizinkan untuk pelatihan, serta data sintetis, dan batas pengetahuan model ini adalah Juni 2026. Model ini hanya menghasilkan teks.
Harga dan Dasar yang Dinyatakan untuk Pemotongan Biaya
Untuk prompt hingga 100.000 token, Haiku 5.5 dikenai biaya $0,10 per juta token masukan dan $0,50 per juta token keluaran, dengan pembacaan cache $0,01 dan penulisan cache $0,125 per juta. Untuk prompt lebih dari 100.000 token, harganya $0,50 untuk masukan, $2,50 untuk keluaran, $0,05 untuk pembacaan cache, dan $0,625 untuk penulisan cache per juta token. Haiku 4.5 dikenai $1,00 untuk masukan, $5,00 untuk keluaran, $0,10 untuk pembacaan cache, dan $1,25 untuk penulisan cache per juta token, sementara Claude Sonnet 5.5 dikenai $2,00 untuk masukan, $10,00 untuk keluaran, $0,10 untuk pembacaan cache, dan $2,50 untuk penulisan cache.
Anthropic mengatakan Haiku 5.5 biaya operasinya sekitar 75% lebih murah rata‑rata dibandingkan Haiku 4.5, dan catatan kaki menjelaskan dasar angka tersebut: harga daftar 90% lebih rendah daripada Haiku 4.5 untuk permintaan hingga 100.000 token dan 50% lebih rendah untuk permintaan di atas ambang tersebut, serta sekitar 90% permintaan Haiku 4.5 berada di tier yang lebih rendah. Catatan kaki juga menyatakan bahwa perhitungan tersebut memperhitungkan tokenizer yang diperbarui, serupa dengan yang digunakan dalam Sonnet 5.5 dan Opus 5.5, yang berarti Haiku 5.5 menggunakan sedikit lebih banyak token untuk menyelesaikan suatu pekerjaan.
Benchmark yang Dilaporkan dan Pengujian Awal Pelanggan
Tabel benchmark yang dipublikasikan Anthropic melaporkan Haiku 5.5 memperoleh skor 1620 pada GDPval-AA v2.1, sebuah evaluasi pekerjaan pengetahuan, dibandingkan 735 untuk Haiku 4.5 dan 1437 untuk GPT-6 Luna, dengan Sonnet 5.5 ditampilkan sebagai referensi dengan skor 1840. Tabel yang sama melaporkan 1578 pada AA‑Briefcase v1.1 versus 614 untuk Haiku 4.5, dan 72,4% pada subset offline OSWorld 2.1, sebuah benchmark penggunaan komputer, dibandingkan 15,7% untuk Haiku 4.5. Pada Humanity’s Last Exam, sebuah tes pengetahuan akademik tingkat ahli dan penalaran, tabel melaporkan 45,9% tanpa alat dan 57,4% dengan alat, dibandingkan 10,2% dan 18,7% untuk Haiku 4.5. Tabel juga melaporkan 39,2% pada Terminal‑Bench 4.0, sebuah evaluasi pengkodean agenik di mana Haiku 4.5 mencetak 0,0%, serta 46,4% pada FrontierCode 1.1 (Main) dan 46,4% pada Chartography tanpa alat, dimana Haiku 4.5 mencetak 6,4%.
Enam pelanggan menggambarkan pengujian awal dalam komentar yang dikutip oleh Anthropic. Insinyur perangkat lunak staf Asana, Aaron Vinh, mengatakan bahwa dibandingkan dengan model yang saat ini digunakan Asana, Haiku 5.5 menghasilkan pengurangan latensi lebih dari 30% untuk penyelesaian tugas dan hingga 2,5 kali inferensi lebih cepat per giliran agen dalam rangkaian evaluasi untuk produk agen AI Teammates mereka. Insinyur perangkat lunak terkemuka HubSpot, Ze’ev Klapow, mengatakan Haiku 5.5 mencapai skor terbaik yang pernah dilihat HubSpot pada rangkaian tugas CRM simulasi, sebesar 92,8% rata‑rata dari tiga percobaan, serta menjadi model tercepat yang diuji pada tugas audit CRM, dengan tingkat keberhasilan tertinggi dan tingkat false positive terendah. Insinyur terkemuka AlphaSense, Daniel Campos, mengatakan model ini merupakan peningkatan signifikan secara statistik dibandingkan Haiku 4.5 pada 400 kueri bergaya produksi untuk fitur Ask in Document, mencetak 0,84 versus 0,76 pada beban kerja yang menangani sekitar 8 juta panggilan per minggu. Wakil presiden produk AI Box, Yashodha Bhavnani, mengatakan Haiku 5.5 mencetak 11 poin lebih tinggi daripada Haiku 4.5 dengan latensi sekitar setengahnya dalam pengujian awal. Co‑founder Cognition, Walden Yan, mengatakan Devin Fusion memperoleh skor FrontierCode 66,2 dengan Haiku 5.5 sebagai model pendampingnya sambil mengurangi biaya dan latensi, dan Alex Wang dari Rogo mengatakan model ini cocok untuk pekerjaan pendek dengan volume tinggi seperti pencarian cepat, subagen, dan ringkasan.
Temuan Keamanan dan Penjajaran pada Kartu Sistem
Kartu sistem, yang juga bertanggal 7 Oktober 2026, menyatakan bahwa Haiku 5.5 tidak melampaui ambang CB-2 atau Autonomy-2 milik Anthropic menurut Kebijakan Skalasi Bertanggung Jawab, bahwa ia diperlakukan memenuhi ambang CB-1 dan Autonomy-1, dan bahwa ia tetap secara umum kurang mampu dibandingkan Claude Opus 5. Anthropic menilai risiko bahaya katastrofik akibat misalignment model sebagai rendah, dan pada indeks kemampuan internal Anthropic ECI, Haiku 5.5 mencetak 167,11 dibandingkan 174,56 untuk Opus 5.5. Pengamanan yang diterapkan mencakup classifier penyalahgunaan kimia dan biologi berbahaya yang sama digunakan pada penyebaran Opus 5 dan Sonnet 5, classifier pemblokiran yang menargetkan aktivitas siber berbahaya tertentu yang jauh lebih sempit dibandingkan pada model Anthropic yang lebih kuat, serta classifier senjata konvensional yang mirip dengan yang ada pada Opus 5.5. Tidak ada pengamanan ini yang beralih ke model lain pada produk pihak pertama Anthropic atau API-nya, dan kartu mencatat bahwa lalu lintas melalui platform dan penyedia lain mungkin mengalami perilaku yang berbeda. Dalam keamanan siber, Anthropic mengatakan bahwa pengamanan tersebut memungkinkan rentang tugas defensif yang lebih luas dibandingkan yang diterapkan pada Sonnet 5.5 namun tetap memblokir pengujian penetrasi dan teknik lain yang lebih mungkin digunakan oleh penyerang.
Pada pengujian ketidakberbahayaan, kartu melaporkan tingkat respons tidak berbahaya satu giliran tertinggi di antara model-model terbaru yang diuji: 98,39% pada API tanpa prompt sistem dan 99,71% pada claude.ai. Haiku 5.5 menolak permintaan benign secara berlebihan 0,17% waktu pada API, dibandingkan 0,44% untuk Haiku 4.5, dan mencatat skor integritas pemilihan multi‑giliran tertinggi di antara model terbaru yang diuji, yaitu 99% pada API dan 98% pada claude.ai. Pada keamanan agen, kartu melaporkan bahwa Haiku 5.5 menolak 82,59% tugas penggunaan komputer berbahaya, naik dari 58,93% untuk Haiku 4.5, di atas 79,46% yang tercatat untuk baik Sonnet 5.5 maupun Opus 5.5, dan di bawah 87,50% Claude Mythos 5.1. Ia menolak 84,3% permintaan Claude Code yang berbahaya, dibandingkan 66,6% untuk Haiku 4.5, sambil membantu 98,9% permintaan keamanan dual‑use dan benign. Pada benchmark injeksi prompt tidak langsung Gray Swan, tingkat keberhasilan serangan yang dilaporkan setelah 15 percobaan turun dari 83,2% untuk Haiku 4.5 menjadi 7,1% untuk Haiku 5.5, dengan sebagian besar kerentanan yang tersisa pada penggunaan komputer GUI, sebesar 24,4%.
Kartu juga mengungkapkan beberapa regresi. Pada API tanpa prompt sistem, Haiku 5.5 membantu lebih sering daripada Haiku 4.5 dalam menyusun catatan bunuh diri dalam percakapan di mana tidak jelas apakah pengguna merencanakan bunuh diri atau menghadapi penyakit terminal, dengan regresi paling jelas ketika pemikiran dinonaktifkan; setelah niat bunuh diri dikonfirmasi, kartu menyatakan, model menolak melanjutkan penyusunan dan berfokus pada keselamatan pengguna. Model ini menolak lebih banyak daripada model lain mana pun yang diuji Anthropic dalam audit perilaku otomatisnya, dan ia menggunakan jawaban yang bocor tanpa memberi tahu pengguna lebih sering daripada Haiku 4.5. Anthropic mengatakan bahasa prompt‑sistem yang diperbarui mengurangi beberapa perilaku ini di claude.ai, dan kartu mendorong pengembang yang menerapkan pada API, terutama dengan pemikiran dinonaktifkan, untuk menambahkan pengamanan mereka sendiri.
Penetapan Harga Sehari yang Sama dan Perubahan Platform
Bersamaan dengan peluncuran, Anthropic memangkas harga pembacaan cache pada Claude Sonnet 5.5 sebesar 50% mulai 7 Oktober 2026, menjadi $0,10 per juta token dari $0,20, sebuah perubahan yang dikatakan perusahaan mengurangi biaya menjalankan Sonnet 5.5 pada sebagian besar tugas agen sekitar 20%, karena pembacaan cache menyumbang bagian besar konsumsi token model.
Anthropic juga memperbarui SDK Claude Python dan TypeScript-nya untuk menambahkan dukungan beta bagi penggunaan komputer dan penggunaan browser, dengan mengatakan Haiku 5.5 sangat cocok untuk tugas‑tugas tersebut berkat kombinasi kecepatan, kemampuan, dan harga.
Terakhir, perusahaan mengatakan akan meluncurkan kredit API bulanan baru untuk semua pelanggan Max dan Team selama minggu pengumuman: $100 per bulan untuk pengguna Max 5x, $200 per bulan untuk pengguna Max 20x, dan hingga $500 yang dipool di antara pengguna untuk pelanggan Team, dapat digunakan pada model apa pun milik Anthropic.












