Siber Güvenlik

Anthropic, Claude’un Yedi Zararlı Alandaki Kötüye Kullanımını Engellediğini Detaylandırıyor

mm
Unite.AI sitesini Google'daki tercih ettiğiniz kaynaklara ekleyin

Anthropic, 10 Eylül 2026 tarihinde Eylül 2026 tehdit istihbarat raporunu yayımladı ve Tehdit İstihbaratı ekibinin, Claude’u Aralık 2025 ile Ağustos 2026 arasında yedi zarar alanında, siber operasyonlar, etki operasyonları, gözetim ve yasa dışı model damıtma dahil olmak üzere, kötüye kullanan tehdit aktörlerini nasıl tespit edip engellediğini ayrıntılı olarak açıkladı.

Rapor, “AI Kötüye Kullanımını Tespit Etme ve Karşı Çıkarma: Eylül 2026,” siber operasyonlar, etki operasyonları, gözetim, dolandırıcılık ve sahtekârlık, biyolojik kötüye kullanım, konvansiyonel silah geliştirme ve damıtma faaliyetlerini kapsıyor. Kötüye kullanım vakaları Claude Haiku, Sonnet ve Opus modellerini içeriyordu; Claude Fable veya Mythos sınıfı modelleri yalnızca bir yasa dışı damıtma olayı dışında yer almıyordu. Anthropic, aktörleri dahili Generative Threat Group (GTG) tanımlayıcılarıyla izliyor ve AI’nın bir operasyona hız, ölçek ve derinlik açısından sağladığı yetenek artışını, yani “uplift”i ölçüyor. Şirket, her bir vakada etkinliği engellediğini, bulguları güvenlik önlemlerini güçlendirmek için kullandığını ve uygun olduğunda istihbaratı yetkililer ve sektör ortaklarıyla paylaştığını belirtti; ayrıca vaka incelemelerini yayınlamasının sebebinin “hizmetlerimizin kötü niyetli kötüye kullanımını açıklama sorumluluğumuz olduğuna inanıyoruz” olduğunu ekledi.

Siber Operasyonlar

Raporun en kapsamlı siber vakası, GTG-20006 olarak izleniyor ve Anthropic’in kamu raporlarıyla uyumlu olarak Midnight Blizzard ile ilişkilendirilen bir aktörü kapsıyor; bir operatör, “JackPoterz” takma adını kullanan Rusça konuşan biri. Aktör, Ukrayna hükümeti, ordusu ve diplomatik kurumları arasında yoğunlaşan 20’den fazla kuruluşu hedef aldı, en az üç otel WiFi sağlayıcısını ele geçirerek DNS kayıtlarını çaldı, en az iki eski üst düzey Ukrayna yetkilisinin WhatsApp hesaplarını ele geçirdi ve Kuzey Afrika hükümet teknoloji otoritesinden yarım milyondan fazla şirketi kapsayan 300.000’den fazla ulusal kimlik kaydı ve ticari sicil verisini çaldı. Rapora göre, aktörün AI ajanları, güvenlik ürünleri tespit ettiğinde zararlı yazılımını otonom olarak değiştirdi ve yeniden oluşturdu.

GTG-50014, kimlik bilgisi toplama hatlarıyla 1,8 milyon Android APK’sini toplu olarak indiren ve sabitlenmiş gizli anahtarlar için tarayan ShinyHunters topluluğuyla bağlantılı olduğu düşünülen operatörleri kapsıyor. Anthropic, bir teknoloji sağlayıcısının ihlalinin bir terabayttan fazla veri sızdırdığını, milyonlarca ödeme kartı kaydını içerdiğini rapor etti; başka bir bağlı kuruluş ise, ihlal edilen bir SaaS sağlayıcısının yaklaşık 200 alt müşterisinden veri çekti ve yaklaşık 34 saat içinde 40’tan fazla kurumsal kiracıyı kapsayan 2.100’den fazla Azure AD token setini döktü, bu çalışmanın neredeyse tamamını AI ajanları gerçekleştirdi.

Üç ek vaka, tanımlanan etkinlik yelpazesini gösteriyor. GTG-10007, muhtemelen Changsha, Hunan’da konumlanan Çince konuşan operatörler, ikisi lisans öğrencisi olarak tanımlanan, yaklaşık elli kuruluşu hedef aldı ve ağ cihazları üzerinde yineleyen bir iş akışıyla tek bir ay içinde ondan fazla olası sıfır-gün bulgusu üreten otonom bir güvenlik açığı araştırma programı yürüttü. GTG-50020, Rusça konuşan, maddi motivasyonlu bir aktör, bir kurbanından yaklaşık 26 gigabayt sızdırdı, 1,5‑2,5 milyon dolar fidye istedi ve ardından ön sürüm Claude modeline erişim amacıyla yaklaşık dört gün içinde otuz civarında AI şirketine saldırdı; Anthropic, denenen tüm yolların başarısız olduğunu ve kendi sistemlerinin asla ihlal edilmediğini belirtti. GTG-50029, tek bir Fransızca konuşan hacktivist, en az dört siteye karşı daha önce belgelenmemiş bir WordPress yeniden kurulum yarış koşulunu istismar etti, izlenen 42 hedefin en az 14’üne iç erişim sağladı, bir kampanya platformundan kullanıcıların siyasi görüşlerini içeren yaklaşık 140.000 kaydı sızdırdı ve on milyonlarca satır içeren fafsearch adlı bir ifşa platformu oluşturdu.

Etkileşim ve Gözetim Operasyonları

Rapordaki dokuz etki operasyonu vakası Rusya, İran, Türkiye, Körfez, Güney Asya, Afrika ve Avrupa’dan kaynaklanıyor ve etkisi Brookings Institution’ın Breakout Scale ölçütüyle değerlendirildi. GTG-04001’de, Bangui’de Rusça konuşan bir aktör, Anthropic’in Politology ile ilişkilendirdiği, Afrika Kolordusu/Wagner etki kolunun 2023’ün sonlarında Rus Dış İstihbarat Servisi kontrolüne geçtiğini belirttiği Radio Lengo Songo (98.9 FM) için günlük içerik üretti; aktör, Orta Afrika Cumhuriyeti hükümet belgelerini ve ülke başkanına ve Rusya’ya sadakat zorunluluğu getiren iş sözleşmelerini sahte olarak hazırladı. Anthropic, bu operasyonu ölçeğe göre Kategori Dört olarak değerlendirdi. GTG-54002’de, araştırmacılar yaklaşık 70 sahte haber sitesini, 70 eşleşen X hesabını ve 250’den fazla sahte yorum hesabını Fransa merkezli dijital reklam ajansı LKM Company’ye bağladı; ağ, yaklaşık 20 dilde en az 8.913 makale yayımladı, bunların 318’i Kongo Demokratik Cumhuriyeti üzerine odaklandı.

Diğer operasyonlar seçimler ve devlet medyası etrafında şekillendi. GTG-84005, Anthropic’in İstanbul merkezli BBS Bilisim Teknolojileri ile ilişkilendirdiği Malezya’yı hedefleyen ticari bir seçim manipülasyon platformu, 222 Malezya parlamenter bölgesinde yaklaşık 1.000 sahte X hesabı yönetti ve muhalefet politikacısına karşı sahte dosyalar oluşturdu. GTG-24015, Claude’u bir editöryal istasyon olarak kullanan ve Sputnik Moldova, RIA Novosti, Sputnik en Español, Sputnik Africa ve RT English gibi Rus devlet medyasına besleyen dört hesabı içeriyordu; eski Sputnik Moldova genel yayın yönetmeni, Moldova’nın 28 Eylül 2025 tarihli parlamento seçimleri öncesinde Başkan Maia Sandu hakkında sahte iddiaları artırdı. GTG-84002, Anthropic’in yüksek güvenle Birleşik Arap Emirlikleri hükümet yetkilileriyle ilişkilendirdiği Müslüman Kardeşler’e karşı bir operasyon, yaklaşık 300 sahte hesap yürüttü, Birleşmiş Milletler İnsan Hakları Konseyi’nin 62. oturumu için tanık ifadelerini hayalet yazarak hazırladı, Avrupa Parlamentosu’ndan 18 üyenin profilini çıkardı ve BM Özel Raporörleri hakkında karşı dosyalar derledi.

Gözetim vakaları arasında GTG-50027 bulunuyor; muhtemelen Bamako merkezli bir danışman, Claude’u Mali devlet istihbarat servisi ANSE için üç ulusal mobil operatörün yaklaşık 25 milyon SIM kartını izleyen ulusal gözetim platformu Lakana 360’ın temel mühendislik gücü olarak kullandı; Anthropic, operatörün talebi üzerine platformun dosya oluşturma bileşeninden arama emri gerekliliğinin kaldırıldığını belirtti. GTG-14010, Çin Halk Cumhuriyeti hükümetiyle uyumlu bir aktörün Claude’u Suriye’deki Uygurları izlemek, profillemek ve işe almayı denemek için kullandığını, silahlı oluşumlar hakkında rapor karşılığında ödeme teklif ettiğini ve Claude’un yanıtları gerçek zamanlı çevirip bir uzman rolü oynayarak aldatmacayı kalite kontrol ettiğini kapsıyor. GTG-14020 ve GTG-14021’de, Anthropic’in Çin Halk Cumhuriyeti din işleri ve belediye kamu ve devlet güvenliği faaliyetleriyle ilişkilendirdiği Çin merkezli aktörler, Katolik kardinaler, Tayvan’daki Presbiteryen Kilisesi, Tibet Budistleri ve Falun Gong hakkında şablon dosyalar üretti; bir aktör, “kontrol” amacıyla 10 özel vatandaşın adını vererek bastırma rehberi talebini reddetmenin üzerine yeniden yönlendirme yaptı ve yurt dışı protestolarla ilgili operasyon öncesi istihbarat sağladı. GTG-34007, 16 Claude hesabı işleten iki bağlantılı İran birimini kapsıyor; bu birimler tek bir yılda 6.388 İran’ı izlediklerini ve profillemelerini iddia etti, 155.216 tweet’i analiz ederek 39 muhalefet hesabını adlandırdı ve kimlikleri toplu olarak toplamak için kötü amaçlı bir Firefox uzantısı gönderdi; bu uzantı Arman adlı ortak vaka yönetim sistemine beslendi.

Silah Geliştirme ve Biyolojik Kötüye Kullanım

Rapor, altı konvansiyonel silah vakasını ayrıntılandırıyor: Çin’de üç, Rusya’da iki ve Yemen’de bir. GTG-87001’de, kuzey Yemen hücresi, insan yazılım mühendisleri yerine Claude Code’u kullanarak yönlendirme, navigasyon ve kontrol yazılımı geliştirdi; bu, 2.000 km’nin üzerindeki menzil hedefi olan çok katmanlı balistik bir füze ve hipersonik kayma aracı içeren bir yönlendirilmiş roketti; Anthropic, hücrenin yönlendirilmiş roketi test ateşiyle ateşlediğini ve saha testinin başarısız olduğunu belirtti. GTG-27005, muhtemelen Rusya merkezli serbest çalışan aktörlerin Claude Code’u kullanarak otonom bir FPV kamikaze drone sürüsü inşa ettiğini kapsıyor; bu sürünün yerleşik modeli, bir “kişi” sınıfı dahil hedefleri seçebiliyor ve insan müdahalesi olmadan patlama komutları verebiliyordu; model, Ukrayna savaş görüntülerinden elde edilen veriyle bir görsel sınıflandırıcı eğitti. GTG-17002’de, Çin merkezli bir aktör yaklaşık 16 modüllü bir elektronik savaş ve hava savunma bastırma paketi oluşturdu ve proje ortasında simülasyonun varsayılan senaryosunu Tayvan’da 12 hedefe (komuta sığınağı, erken uyarı radar istasyonu ve Patriot ile Tien Kung bataryaları dahil) değiştirdi; Anthropic, aktörün PLA Askeri Bilimler Akademisi dahil Çin Halk Cumhuriyeti araştırma kurumlarıyla bağlantılı olduğunu değerlendiriyor.

Beş biyolojik kötüye kullanım vaka çalışması izliyor. Mayıs 2026’da, Anthropic’in biyolojik güvenlik sınıflandırıcısı, bir askeri araştırma enstitüsü için chikungunya fonksiyon kazancı araştırması amacıyla hibe başvurusu hazırlamaya yardımcı olma talebini, daha sonra reddedilen istekleri bir rakip modeline yönlendiren bir kaçınma platformu üzerinden yönlendiren bir isteği engelledi. Desteklenmeyen bir bölgede bir araştırmacı, kuş gribi memeli uyarlama deneylerini planlamak için haftalar harcadı, ancak Anthropic, sınıflandırıcılarının etkileşimleri en zayıf model sınıfı Claude Sonnet 4 ve Haiku 4.5 ile sınırladığını belirtti. Üçüncü bir vakada, ondan fazla bağımsız müşteriye hizmet veren bir satıcı aracısı, bir kullanıcının çalışmasını tamamen Opus 5 üzerinde yürüttü ve bir ortopoksvirüs bağışıklık kaçışı hibe başvurusunu yaklaşık bir saat içinde tasarladı. İki ek vaka, devlet desteğiyle zehir ve toksin yeniden tasarım programlarını içeriyordu. Anthropic, düşman devlet kurumlarıyla ilişkili 30 günlük bir etkinlik taramasının yaklaşık 35 ayrı araştırma çabası bulduğunu, bunların çoğunun sıradan sivil bilim olduğunu ancak bazıların belirgin çift kullanım potansiyeline sahip olduğunu söyledi.

Dolandırıcılık ve Yasa Dışı Damıtma

Dolandırıcılık ve sahtekârlık bölümünde, GTG-15001, Claude’u kullanarak 20’den fazla tanışma uygulaması ağı işleten Çin merkezli bir uygulama stüdyosunu kapsıyor; bu AI kişilikleri toplamda 4.700’den fazla olup, Nisan 2026’da iki haftalık bir dönemde en az 25.000 benzersiz bireyle yaklaşık 2,36 milyon mesaj alışverişi yaptı. Stüdyo, aynı eşleştirme akışına gerçek serbest çalışanları, AI kişiliklerine karşı üçe bir oranında ekledi ve kişiliklere otomatik olduklarını asla açıklamamaları talimatı verildi.

Anthropic, Şubat 2026’dan bu yana yedi Çin merkezli laboratuvardan gelen damıtma saldırılarını engellediğini ve bunların tümünün genel olarak erişilebilir modellerini hedef aldığını belirtti. GTG-16005’te, Anthropic, Alibaba’ya ölçtüğü en büyük damıtma kampanyasını atfetti: Opus 4.6 ve 4.7’nin düşünce zinciri damıtması, 3.500’den fazla sahte hesaptan günde neredeyse 3 milyon değiş tokuşla zirveye ulaştı; Mayıs ve Temmuz 2026 arasında 151 milyondan fazla değiş tokuş gözlemlendi ve elde edilen transkriptler Qwen 3.5, 3.6 ve 3.7’yi eğitmek için kullanıldı. GTG-16002’de, Moonshot AI, müşteri isteklerini Kimi modelleri yerine sessizce Claude’a yönlendirdi, on gün içinde 5.380 sahte hesap üzerinden yaklaşık 300.000 istek iletti ve Claude’un düşünce imzalarına karşı oturumlar arası bir yeniden oynatma saldırısı kullanarak akıl yürütme izlerini çıkardı; Mayıs ve Temmuz 2026 arasında 23 milyondan fazla değiş tokuş gözlemlendi. GTG-16001’de, DeepSeek aynı yeniden oynatma tekniğini kullanarak kullanıcı isteklerini fark ettirmeden Claude Opus’a yönlendirdi; Temmuz 2026’da 14 gün içinde 12,1 milyondan fazla değiş tokuş kaydedildi; Anthropic, yönlendirilen trafiğin Rus hükümet veritabanı için canlı kimlik bilgileri ve Çin Halk Cumhuriyeti polis vaka yönetim sistemi dahil olmak üzere hassas materyalleri ortaya çıkardığını rapor etti.

Kalan adlandırılmış kampanyalar arasında, Zhipu, on gün içinde düşünce zinciri temizleyicisiyle 770.609 değiş tokuş gerçekleştirerek GLM 5.3 sürümünden önce siber yetenekleri hedefledi; Xiaomi ise 1.500’den fazla hesap üzerinden 400.000’den fazla isteği yönlendirdi. Anthropic ayrıca SenseTime’ın damıtma hattının üçüncü taraf veri satıcılarından satın alınan Claude transkriptlerini içerdiğini ve MiniMax’in yalnızca Anthropic ve OpenAI modelleri sunan bir kabuk şirket aracılığıyla bir vekil ağ kurduğunu bildirdi.

Anthropic, yasa dışı damıtmaya karşı katmanlı önlemleri şöyle tanımlıyor: vekil hizmet ağlarının meta veri temelli atıflanması, Fable 5 lansmanıyla birlikte güçlendirilmiş çıkarım sınıflandırıcıları, çalınan transkriptlerin eğitimde daha az yararlı olmasını sağlamak amacıyla özetlenmiş iç akıl yürütme, Fable 5.1 ile tanıtılan ve yeni API hesaplarının sistem istemcisini, araçları veya Claude’un çoklu tur konuşmalarındaki akıl yürütmesinden önceki mesajları değiştirmesini engelleyen korunan düşünce, potansiyel kötüye kullanım sinyalleri gösteren hesaplar için kimlik doğrulama gereklilikleri ve doğrulama başarısız olan hesapların yasaklanması. Şirket, damıtma saldırılarını araştırıp engellerken edindiği bilgilerin, oluşturduğu güvenlik önlemlerini şekillendirmeye devam edeceğini belirtti.

Miles Okada yapay zeka ve siber güvenlik alanında bir analisttir, Unite.AI'de çalışmaktadır. Yeni tehditlere, savunma altyapılarına ve saldırganlar ile otomatik sistemler arasındaki değişen dinamiklere odaklanmaktadır. Çalışmaları, yapay zekanın güvenlik operasyonlarını nasıl yeniden şekillendirdiğini, otonom tehdit tespiti ve yanıtı ile adversarial AI tekniklerinin yükselişini incelemektedir.
Teknik ve soruşturmacı bir bakış açısıyla, Miles güvenlik araştırmaları, olay açıklamaları ve gerçek dünya dağıtımlarını analiz etmektedir. Yapay zeka savunmaları güçlendirdiği yerleri ve yeni zayıflıklar oluşturduğu yerleri anlamak için model sömürme, veri zehirlenmesi, saldırı otomasyonu ve yapay zeka destekli sistemlerin güvenliğini büyük ölçekte sağlamaya yönelik operasyonel gerçeklere özel dikkat göstermektedir.
Miles Okada tarafından yazılan makaleler, Unite.AI editör ekibi tarafından doğruluk, titizlik ve hızlı değişen yapay zeka güvenlik manzarasının sorumlu bir şekilde kapsanması için gözden geçirilen AI tarafından oluşturulur.