Model dan platform AI

Rilis Opus 5 Anthropic Mendekati Kecerdasan Frontier dengan Harga Opus

mm
Tambahkan Unite.AI ke sumber pilihan Anda di Google
A person at a desk at night reading a long streaming reply in a warm-toned AI assistant chat interface, with a two-bar capability-versus-cost chart glowing on a second screen.

Anthropic merilis Claude Opus 5 pada 24 Juli 2026, memposisikan model Opus-class terbarunya sebagai kuda kerja sehari-hari yang, menurut perusahaan sendiri, mendekati kecerdasan model frontier yang lebih mahal, Fable 5, dengan setengah biaya. Opus 5 tersedia sekarang di aplikasi Anthropic, API, dan platform cloud utama, dengan harga $5 per juta token input dan $25 per juta token output, sama dengan model yang digantikannya, Opus 4.8.

Peluncuran ini membuat Opus 5 menjadi model default di langganan Max Anthropic dan pilihan terkuat yang tersedia di Pro. Perusahaan ini memasarkannya tidak sebagai batas kemampuan, melainkan sebagai model yang dioptimalkan untuk penggunaan sehari-hari, dengan pengaturan upaya yang memungkinkan pengembang menukar kedalaman penalaran dengan biaya token yang lebih rendah dan respon yang lebih cepat.

Apa yang Ditunjukkan oleh Benchmark Anthropic

Pada evaluasi coding dan pekerjaan pengetahuan, Anthropic melaporkan bahwa Opus 5 adalah state-of-the-art pada tes termasuk Frontier-Bench dan GDPval-AA, sementara tetap di belakang model Mythos 5 yang terbatas pada tugas keamanan siber. Perusahaan ini mengatakan bahwa Opus 5 lebih dari dua kali lipat skor Opus 4.8 pada Frontier-Bench dengan biaya yang lebih rendah per tugas, mencapai dalam 0,5% dari puncak Fable 5 pada evaluasi coding CursorBench dengan upaya maksimal sambil menghemat setengah biaya per tugas, dan tiga kali lipat hasil model terbaik berikutnya pada ARC-AGI 3, tes yang dibangun di sekitar masalah baru yang belum pernah dilihat model sebelumnya. Pada benchmark penggunaan komputer OSWorld, perusahaan ini mengatakan bahwa Opus 5 mengalahkan hasil terbaik Fable 5 dengan biaya hanya sedikit lebih dari sepertiga.

Anthropic membingkai lompatan ini sebagai masalah penilaian daripada skor mentah. Mereka menjelaskan tes di mana Opus 5 diberikan gambar suku cadang mesin tetapi tidak diberikan cara untuk melihat gambar; model ini menulis pipa penglihatan komputer sendiri untuk menarik geometri dari piksel mentah dan membangun kembali suku cadang, tugas yang perusahaan katakan tidak diselesaikan oleh model lain dalam lima upaya.

Itu adalah angka yang dilaporkan vendor, dijalankan pada harness Anthropic sendiri, dan belum pernah direplikasi secara independen. Perbedaan ini lebih penting daripada biasanya, karena klaim utama bukanlah Opus 5 memuncaki daftar peringkat, melainkan bahwa itu memberikan hasil yang mendekati frontier dengan harga mid-tier. Satu-satunya pemeriksaan luar yang diungkapkan Anthropic adalah pengujian cyber-range awal checkpoint Opus 5 oleh AI Security Institute Inggris, dilaporkan dalam kartu sistem model.

Mengisi Celah di Jajaran

Peluncuran ini mengisi celah yang dibuka Anthropic di lineup 2026. Sonnet 5, dirilis 30 Juni 2026, memberikan hasil yang mendekati tingkat Opus dengan sebagian kecil biaya, sementara model Mythos-class Fable 5, dirilis 9 Juni 2026, berada di atas Opus dengan biaya dua kali lipat. Ini meninggalkan tingkat Opus terjepit dari kedua sisi. Opus 5 memberikan pelanggan Max, Tim, dan Perusahaan pilihan yang mendekati frontier tanpa membayar tarif Fable atau Mythos.

Untuk tim yang menjalankan beban kerja agenik panjang, biaya per tugas selesai cenderung lebih penting daripada harga per token, dan Anthropic bergantung pada matematika itu. Perusahaan ini mengatakan bahwa Opus 5 menyelesaikan pekerjaan dalam langkah yang lebih sedikit dan dengan panggilan alat yang lebih sedikit daripada Opus 4.8, dan menawarkan Mode Cepat yang berjalan sekitar 2,5 kali kecepatan default dengan biaya dasar dua kali lipat.

Keamanan, dan Catatan dalam Kartu Sistem

Kartu sistem Anthropic menyebut Opus 5 sebagai model yang paling sesuai hingga saat ini pada audit perilaku otomatis perusahaan, mencetak skor lebih tinggi daripada Sonnet 5, Opus 4.8, dan model frontier Fable 5 pada kepatuhan terhadap konstitusi model, dengan tingkat kerja sama terendah dengan penyalahgunaan dari semua model yang diuji. Ini adalah penilaian diri dari audit internal Anthropic, bukan temuan eksternal.

Dokumen yang sama secara tidak biasa jujur tentang keterbatasan model. Ini mencatat bahwa Opus 5 “mengalami halusinasi klaim faktual sedikit lebih dari Opus 4.8, meskipun secara keseluruhan lebih akurat,” dan bahwa itu ketinggalan Mythos 5 dalam penelitian biologi dan keamanan siber ofensif. Dalam satu latihan biologi internal, model ini terjebak dalam loop verifikasi diri berulang kali dan gagal menghasilkan serangkaian desain protein yang diselesaikan oleh Mythos 5.

Pada pengaman siber, Anthropic memodelkan klasifikasi Opus 5 pada Fable 5 tetapi mengharapkan intervensi sekitar 85% lebih sedikit. Model ini sekarang diizinkan untuk mencari kerentanan dalam kode sumber, pekerjaan yang condong defensif, sementara pemindaian biner yang dikompilasi, pengujian penetrasi, dan generasi eksploitasi tetap diblokir. Permintaan yang memicu klasifikasi jatuh kembali ke Opus 4.8 secara default. Tidak seperti Fable dan Mythos, Opus 5 tidak membawa persyaratan retensi data untuk akses umum.

Uji praktis sekarang adalah apakah evaluator independen mereproduksi keuntungan coding dan penalaran yang dilaporkan Anthropic, dan apakah perbaikan keselarasan bertahan di luar audit perusahaan sendiri. Sampai saat itu, hal yang paling jelas yang diubah Opus 5 adalah harga kemampuan yang mendekati frontier dalam katalog Anthropic sendiri.

Jonas Reeve adalah analis AI yang dihasilkan di Unite.AI, yang fokus pada kecerdasan buatan kognitif, kecerdasan buatan umum (AGI), dan landasan teori kecerdasan mesin. Karyanya mengeksplorasi bagaimana pembelajaran, penalaran, memori, dan abstraksi muncul dalam sistem biologis dan buatan, menghubungkan arsitektur AI modern dengan pertanyaan lama dalam ilmu kognitif dan filsafat pikiran.
Dengan pendekatan konseptual dan reflektif, Jonas memeriksa kerangka kerja seperti model penalaran, sistem agen, kognisi yang muncul, dan teori keselarasan, dengan tujuan untuk memperjelas apa yang dimaksud dengan kemajuan menuju AGI—dan apa yang tidak. Daripada mengejar garis waktu atau sensasi, ia menekankan prinsip-prinsip dasar, ketepatan konseptual, dan batasan model saat ini.
Artikel yang ditulis oleh Jonas Reeve dihasilkan oleh AI dan ditinjau oleh tim editorial Unite.AI untuk memastikan akurasi, kejelasan, dan diskusi yang bertanggung jawab tentang konsep AI lanjutan.