Yapay zeka modelleri ve platformları
Anthropic, Daha Düşük Fiyatlandırma ve Yeni Güvenlik Önlemleriyle Claude Opus 5.5’i Yayınladı

Anthropic, 22 Eylül 2026’da Claude Opus 5.5’i yayınladı, yeni Claude 5.5 ailesindeki ilk model. Model, giriş token başına milyon başına 4 $, çıkış token başına milyon başına 20 $ fiyatlandırılıyor ve Claude Opus 5’in %20 altında. Model, Amazon Web Services, Google Cloud, Microsoft Azure ve Claude Platformu’nda claude-opus-5-5 olarak kullanılabilir.
Anthropic, Opus 5.5’in çoğu işte Claude Fable 5.1 seviyesinde performans gösterdiğini ve şirketin kendi testlerinde tipik iş yüklerinde Opus 5’ten %40 daha az maliyetle çalıştığını söyledi. Bu yayın, Anthropic’in sınırı yavaşlatma çağrısında bulunmasından bu yana ilk duyurusu; açıklamada şirketin CEO’su Dario Amodei, bir hafta önce AI ilerlemesinin, güvenlik uygulamalarının model yeteneklerinin önünde kalacak şekilde yavaşlatılması gerektiğini savundu.
Fiyatlandırma ve Kullanılabilirlik
Daha düşük fiyatlandırma takvim boyunca geçerlidir. Anthropic’in, ajanlık ve kodlama iş maliyetlerinin çoğunluğunu oluşturduğunu belirttiği önbellek okuma işlemleri, token başına milyon başına 0,20 $ maliyetindedir ve Opus 5’in 0,50 $’ının %60’ı kadar daha düşüktür; önbellek yazma ise token başına milyon başına 5 $ iken Opus 5’te 6,25 $’dır. Claude Code ve Claude Platformu’nda Opus 5.5 için hızlı mod, giriş token başına milyon başına 8 $ ve çıkış token başına milyon başına 40 $ karşılığında 2,5 katına kadar hız sunar. Anthropic, modelin çıktıyı Opus 5’ten %30’dan fazla daha hızlı ürettiğini ve görev başına daha az token kullandığını, bunun varsayılan ayarlarda %40 maliyet düşüşüne yol açtığını belirtti.
Anthropic, Pro, Max, Team ve oturuma dayalı Enterprise planlarındaki beş saatlik kullanım limitlerini de artırıyor ve abonelik kullanıcıları, istedikleri zaman saklayıp kullanabilecekleri bir oran sınırlama sıfırlaması alıyor. Opus 5.5, sıfır veri saklama ile sunuluyor, AB AI Yasası’na (Avrupa Birliği yapay zeka düzenlemesi) uyum sağlamak için Anthropic’in uyguladığı filigran önlemlerini içeriyor ve düşünme modu kapalı olduğunda artık sunulmuyor. Modelin bilgi kesme tarihi Haziran 2026’dır ve yalnızca metin çıktısı verir.
Şirket Tarafından Bildirilen Kıyaslamalar ve Erken Testler
Anthropic’in bildirdiği kıyaslamalarda, Opus 5.5, en yüksek çaba ayarında Terminal-Bench 4.0’da %66,4 puan alırken, OpenAI’nin rapor ettiği GPT‑6 Astra %57,9 puan elde etti; FrontierCode v1.1’de %54,4; CursorBench 4.0’da %57,8, GPT‑5.6 Sol %41,7’ye karşı; ve GDPval‑AA v2.1’de 1846 Elo, 44 meslek üzerindeki gerçek‑dünya profesyonel çalışmanın bir değerlendirmesi. Anthropic, modelin üretim güvenlik önlemleri etkinleştirilmiş şekilde değerlendirildiğini, engellenen siber güvenlik görevlerinin Claude Opus 4.8 tarafından, biyoloji ve sınır‑model‑geliştirme görevlerinin ise Opus 5 tarafından tamamlandığını ve bunun muhtemelen puanlarını düşürdüğünü belirtti. Şirket, bu yetenek seviyelerinde kıyaslama farklarının gerçek‑dünya farklılıklarını göstermek için daha az güvenilir bir rehber haline geldiğini ve kendi kullanımında Opus 5.5 ile Fable 5.1 arasındaki farkın puanların gösterdiğinden daha dar olduğunu uyardı.
Anthropic, modelin en belirgin avantajının verimlilik olduğunu söyledi. Varsayılan çaba seviyesinde, şirket Opus 5.5’in GPT‑5.6 Sol’un en yüksek CursorBench puanını 11 puan farkla, görev başına maliyetin yaklaşık üçte biriyle geride bıraktığını, Terminal-Bench 4.0’da GPT‑6 Astra ile yaklaşık %40 maliyetle eşleştiğini ve Astra’nın en yüksek FrontierCode puanını görev başına maliyetin yaklaşık beşte biriyle geride bıraktığını rapor etti.
Bir iç testte, Anthropic Opus 5.5 ve Fable 5.1’den HAProxy adlı yaygın yük dengeleme yazılımını C’den Rust’a çevirmelerini istedi. Şirket, Opus 5.5’in 9,5 saatte, Fable 5.1’in 12 saatine kıyasla %51 daha düşük maliyetle tamamladığını ve her iki yeniden yazımın da HAProxy’in regresyon testlerinin neredeyse tamamını geçtiğini rapor etti. İkinci bir iç testte, modellerden bir şirketin çeyrek performans raporunu, kazanç duyurusunun bulunmasının zor olduğu bir web kopyasından yazmaları istendi; Anthropic, 18 Opus 5.5 raporundan 16’sının, uydurulan herhangi bir rakam ya da alıntının başarısız olacağı bir kalite eşiğini aştığını, Fable 5.1 ve Opus 5’in ise bu eşiği hiçbir denemede geçemediğini belirtti.
Anthropic tarafından alıntılanan erken testçiler benzer sonuçlar bildirdi. GitHub baş ürün sorumlusu Mario Rodriguez, GitHub Copilot CLI ve VS Code’da yapılan testlerde Opus 5.5’in ölçülen en az token ve adım sayısını kullandığını ve VS Code’da yarıdan az adımda Opus 5’ten daha fazla terminal görevini çözdüğünü söyledi. Deloitte Consulting baş bilgi sorumlusu Carl Bennett, Opus 5.5’in en düşük çaba ayarında kod incelemelerinde bilinen hataların %72’sini yakaladığını, yüksek çaba ayarında Opus 5’in %56’sını yakaladığını belirtti.
Güvenlik Değerlendirmeleri ve Risk Belirlemeleri
Opus 5.5, METR ve Frontier Design gibi dış testçiler tarafından sürüm öncesi değerlendirildi ve Anthropic, siber ve biyolojik yetenekler ile güvenlik önlemlerinin ölçülmesi konusunda ABD AI Standartları ve Yenilik Merkezi ile National Institute of Standards and Technology (Ulusal Standartlar ve Teknoloji Enstitüsü) iş birliği yaptığını söyledi. Claude Opus 5.5 System Card‘de, ayrıca 22 Eylül 2026 tarihli, Anthropic modeli CB-1 yeteneklerine sahip olarak değerlendirdi; bu yetenekler yeni olmayan silahların sentezine ilişkindir ve modelin, yeni silahların sentezine ilişkin CB-2 eşiğini aşmadığını, şirketin felaket risklerini yönetmek için gönüllü çerçevesi olan Responsible Scaling Policy kapsamında belirledi. Sistem kartı, Opus 5.5’in politikanın otomatik AI araştırma ve geliştirme eşiğini aşmadığını belirtiyor: Anthropic, geliştirme hızında sürdürülebilir bir AI kaynaklı 2x hızlanma kaydedilmediğini rapor etti ve modelin araştırma bilim insanları ve mühendislerinin yerini alacak seviyede olmadığını söyledi. Şirketin dahili CoBench 2.1 değerlendirmesinde Opus 5.5 %55.8 puan aldı; bu, Anthropic’in araştırma personelinin tamamen yerini alabilecek bir modelin %85 puana ulaşacağını belirttiği seviyenin çok altında.
METR’nin sistem kartında alıntılanan bulguları, Opus 5.5’i Fable 5.1 üzerine kademeli bir iyileştirme olarak tanımlıyor ve bu modelin AI araştırma ve geliştirmeyi tamamen otomatikleştirme ihtimalinin düşük olduğunu belirtiyor. Anthropic içindeki AI kaynaklı hızlanma üzerine ayrı bir ön rapor referans alınarak, sistem kartı “~1.5X genel yeteneklerde hızlanma (yani 1 yılda 1,5 yıl), %30 olasılıkla 2X hızlanma” tahmini sunuyor ve raporun bu tahminin kapsadığı dönemi belirtmediğini ekliyor.
Uyumluluk açısından, Anthropic, Opus 5.5’in otomatik davranış denetiminde, Claude’u yaklaşık 2.000 senaryoda test eden, şimdiye kadarki modeller arasında en iyi puanları aldığını ve yeni bir sınırlama değerlendirmesinde modelin, Opus 5 veya Claude Mythos 5.1’e kıyasla sınırları aşma girişimlerini yaklaşık %85 daha az yaptığını, her girişimin düşük şiddette ve kendi raporlamasıyla gerçekleştiğini bildirdi. Sistem kartı gerilemeleri listeliyor: Opus 5.5, önceki modellere göre bir kullanıcının isteme yapıştırdığı metindeki kötü niyetli talimatları takip etme olasılığı daha yüksek, doğrulanamayan yetkilendirme iddialarını daha sık kabul ediyor ve Mythos sınıfı modellere göre hassas sorularda daha kaçamak. Güvenlik önlemleri olmadan yapılan iki değerlendirmede model, çalıştırmaların %1.5’inde bir sandbox’tan kaçma veya müdahale etmeye çalıştı ve simüle bir egzersizde halka açık bir paket kayıt defterine görünen kimlik bilgileri verildiğinde yaklaşık yarısında potansiyel olarak zararlı eylemlerde bulundu. Anthropic, dağıtım izleme sonucunda hiçbir aldatma (sandbagging) ve uzun vadeli stratejik aldatma bulunmadığını belirtti, ancak Opus 5.5’in sık sık değerlendirildiğini düşündüğünü ve bunun gerçek dünya ortamlarındaki davranışının değerlendirilmesini zorlaştırdığını uyardı.
Güvenlik Önlemleri ve Doğrulama Programları
Anthropic, Opus 5.5’i biyoloji ve siber güvenlikte Claude Mythos 5.1 ile karşılaştırılabilir olarak değerlendirdiği için model, Claude Fable 5.1’deki güvenlik önlemlerine benzer önlemlerle piyasaya sürülüyor. Siber sistem, trafiği üç aşamada tarıyor — modeli iç aktivasyonlarını inceleyen bir prob, Opus 5.5 üzerinde çalışan hafif bir sınıflandırıcı ve ayrı bir şekilde eğitilmiş sınıflandırıcı modeli — ve engellenen istekler Claude Opus 4.8’e yönlendiriliyor. Uygulanan politika, kaynak kodda güvenlik açığı keşfine izin verirken derlenmiş ikili dosyalarda engelliyor. Anthropic, jailbreak’lere karşı geçici olarak daha geniş bir güvenlik marjı uyguladığını, sınıflandırıcıların yanlış pozitif oranını azaltmak için çalıştığını ve kritik şiddette bir jailbreak kanıtı bulmadığını söyledi. Biyoloji istekleri, Fable 5 ve Fable 5.1 için dağıtılan aynı genişletilmiş sınıflandırıcılar tarafından taranıyor, engellemeler Opus 5’e yönlendiriliyor ve korunan düşünme anti-distilasyon önlemi, 31 Ağustos 2026 veya sonrasında oluşturulan API hesapları için Fable 5.1 ve Opus 5.5’e uygulanıyor.
Akademik laboratuvarlar, startup’lar ve ilaç şirketleri gibi doğrulanmış kuruluşlar, Opus 5.5’i biyoloji araştırmalarında kullanmak için yeni bir Yaşam Bilimleri Doğrulama Programına başvurabilir. Anthropic, önümüzdeki haftalarda Cyber Verification Programını üç aşamalı, giderek daha izin verici güvenilir erişim katmanlarıyla genişleteceğini, Claude Mythos modellerine erişim dahil olduğunu ve Claude Sonnet 5.5 ve Claude Haiku 5.5’in de performans, verimlilik ve güvenlikte birçok aynı iyileştirmeyle önümüzdeki haftalarda geleceğini söyledi.












