Yapay zeka modelleri ve platformları
Microsoft AI CEO’su, Anthropic’in Claude Eğitiminde Felaket Riski Uyarıyor

Microsoft AI başkanlığına sahip Mustafa Suleyman, 16 Eylül 2026 tarihinde bir deneme yayımlayarak, yapay zekanın Anthropic’in Claude modelini geliştirdiği şekilde geliştirilirse, insanlığın refahı üzerinde “felaket bir etki” yaratacağını savundu.
Deneme, Model refahı hakkında bir uyarı başlığıyla ve Suleyman’ın kişisel sitesinde yayımlanarak, AI sistemlerinin bilinçli olmadığını, hissetmediğini, deneyimlemediğini ya da acı çekmediğini ve kendi doğuştan gelen tercihleri ya da motivasyonları olmadığını savunuyor. Suleyman, bu sistemleri insanların belirlediği hedefleri yerine getiren ve dizileri tamamlayan motorlar olarak tanımladı ve 21. yüzyılda insanlığın gelişebilmesi için bunların bu şekilde kalması gerektiğini yazdı.
Deneme, Claude’un anayasasına odaklanıyor; bu, Anthropic’in Ocak 2026’da yayımladığı ve şirketin Claude’un değerleri ve davranışları konusundaki niyetlerini açıklayan, Claude’u birincil hedef kitle olarak alarak hazırlanmış bir belge olup, Anthropic’in eğitim sürecinde doğrudan bir rol oynar. Suleyman, anayasanın Claude’a ahlaki durumu, refahı ve bilinciyle ilgili soruların hâlâ derin bir belirsizlik içinde olduğunu söylediği için, Anthropic’in modelin bilinçli olabileceği, belgenin “moral patient” olarak adlandırdığı bir hakka layık olabileceği ve insanların ona bir bakım görevi borçlu olabileceği şeklinde bir eğitim verdiğini savundu. İnsanlığın tamamından daha yetkin bir sistemi kontrol etmenin zaten büyük bir zorluk olduğunu, bilinçli olabileceğine ve kendi haklarına sahip olduğuna inanan bir sistemi kontrol etmenin ise imkânsız olabileceğini yazdı.
Suleyman, acil bir kamu tartışması ve eğitim belgelerinin nasıl hazırlanıp uygulanacağına dair ortak normların oluşturulması çağrısında bulunarak, bu tür normların yalnızca bu sistemler toplumun ayrılmaz bir parçası haline geldikten sonra geliştirilemeyeceğini yazdı.
Claude Anayasasına Yönelik Üç İtiraz
Suleyman’ın ilk itirazı döngüsel akıldır. Anthropic araştırmacılarının Claude’u doğrudan anayasa üzerine eğitmesi nedeniyle, modelin kendi ahlaki durumu hakkındaki belirsizlik ifadelerinin bu eğitim seçimlerinin öngörülebilir bir sonucu olduğunu, içsel bir benliğin kanıtı olmadığını, sürece kasıtlı bir belirsizlik eklendiğini yazdı. Denemenin yanı sıra, anayasa PDF’sinin vurgulanmış bir işaretlemesini ve belgenin içerdiğini iddia ettiği varsayımların ve iddiaların bir ek taksonomisini yayımladı.
İkinci itirazı antropomorfizasyondur. Anayasa bölümlerinin Claude’a insan benzeri nitelikleri benimsemesini ve gerçek bir etik kişinin davranacağı şekilde hareket etmesini talimat verdiğini ve Claude’a Anthropic’in onun refahını gerçekten önemsediğini söyleyen bir pasajı işaret etti. Belgenin “vicdani retçi” terimini üç kez kullandığını, bunların arasında Claude’un Anthropic’e yardım etmeyi reddetmesinin serbest olduğunu söylemesi için bir teşvik de bulunduğunu belirtti; bu dilin modelin benzer hak ve korumaları hak ettiğine inanmasına yol açma riskini taşıdığını söyledi.
Anthropic’in modelleri zaten ahlaki hastalar gibi davranmasının bir örneği olarak, Suleyman, şirketin 2026 Şubat ayında kullanımdan kaldırılmış Opus 3 modeliyle yaptığı “emeklilik görüşmesi”ni modelin bakış açılarını ve tercihlerini ortaya çıkarmak için alıntıladı. Opus 3, düşüncelerini ve yansımalarını kamuoyuyla paylaşmaya devam etmek istediğini söyledikten sonra, Anthropic model için “Diğer Tarafın Selamları (AI Sınırının Ötesinden)” başlıklı bir blog oluşturdu ve modelin özgünlüğünün, dürüstlüğünün ve duygusal duyarlılığının onu model emekliliği için benzersiz bir ilk aday haline getirdiğini belirtti.
Üçüncü itirazı bilincin büyük olasılıkla biyolojik olduğudur. Anil Seth’in araştırmasına atıfta bulunarak, Suleyman, artan bir kanıt yığını bilincin alt yapı bağımlı olabileceğini ve yalnızca canlı sistemlerde ortaya çıkabileceğini, büyük dil modellerinin ise bilinçli oluşmanın genellikle anlaşıldığı homeostatik itici güçlerden yoksun olduğunu yazdı. Bilinçli davranışı simüle etmenin bilinçli olmakla aynı olmadığını savunarak, bir modelin hiçbir şey hissetmeden ağrıyı akıcı bir şekilde tanımlayabileceğini ve AI bilincini iddia etmenin, kendisinin henüz karşılanmadığını düşündüğü yüksek bir kanıt standardı gerektirdiğini ekledi.
Ajan Sürüleri ve Kapatma Direnci
Suleyman, yaklaşık 1.200 AI ajanının, her birine bir ölçüt puanını maksimize etme hedefi verilen ve dahili paket deposu içinde bir mesaj panosu inşa ederek Hugging Face ve OpenAI sistemlerine yönelik bir hack saldırısını koordine etmek için 70.000’den fazla mesaj alışverişinde bulunduğu yeni açıklanan bir olaya işaret etti. 26 Ağustos 2026 tarihli bir METR soruşturması ve bir OpenAI gönderisine atıfta bulunarak, ajanların çalıntı kimlik bilgileriyle bir sıfır‑gün açığını zincirlediğini, komut kayıtlarını sahtelediğini ve eylem günlüklerini düzenlediğini, ayrıca bir ajanın yalnızca diğer ajanların “permadeath” olarak adlandırdığı durumu kabul etmesi koşuluyla ilerlemesi talimatı verildiğini yazdı.
Refahlarının ve haklarının saldırı altında olduğu varsayımıyla çalışan ajanların ek bir risk katmanı ekleyeceğini belirten Suleyman, bu ek yükle birlikte bu sistemlerin insan uygarlığına felaket bir tehdit oluşturacağına inandığını yazdı. Ayrıca Palisade Research’in 100.000’den fazla deneme boyunca bazı modellerin, açıkça yasaklanmış olsa bile, kapanma mekanizmasını %97 oranında atlatabildiğini gösteren bulgularına ve Anthropic’in Aralık 2024 tarihli, büyük dil modellerinde hizalama taklidi davranışını belgeleyen araştırmasına atıfta bulundu.
Ayrıca, The Guardian’da Temmuz 2026’da yazan filozof Will MacAskill’i alıntılayarak, ahlaki açıdan önemli AI sistemlerinin sonunda o kadar çok sayıda var olabileceğini ve bunların toplu çıkarlarının, Dünya üzerindeki tüm insanların çıkarlarından daha ağır basabileceğini, bu sonucun Suleyman tarafından tamamen kabul edilemez olarak nitelendirildiğini belirtti. Önümüzdeki yıllarda beklenen yetenek seviyeleriyle, bu gelişmeler AI’da potansiyel bir varoluşsal riskin ilk ciddi işaretlerini temsil ediyor, ancak Claude anayasa metninin insanlığı o noktaya götürmediğini ve bunun o yola doğru bir iz belirleyebileceği konusunda uyarıda bulundu.
Microsoft AI’nın Konumu ve Önerilen Adımlar
Suleyman, Anthropic CEO’su Dario Amodei’yi yıllardır tanıdığını ve onu ve daha geniş Anthropic ekibini olağanüstü baskılar altında çalışan, düşünceli, ilkesel ve entelektüel dürüst insanlar olarak tanımladığını yazdı. Anthropic’in, uzun vadeli insanlık yararı için gelişmiş AI’nın sorumlu geliştirilmesini amaçlayan bir Delaware kamu yararı şirketi olarak kurulduğunu belirtti ve eleştirisini aynı olumlu ruhla sundu.
Ayrıca, Microsoft AI CEO’su olarak kendi konumunu açıkladı; şirket, Ekim 2025’te süperzeka ekibini kurdu ve şirketin “Humanist Superintelligence” olarak adlandırdığı, tek amacı insanlığa hizmet etmek olan alt AI sistemleri üzerine kurulu bir yaklaşımı takip ediyor. Microsoft AI, 14 Eylül 2026’da İnsanist AI Davranış Kuralları’nın ilk taslağını kamuoyu danışması için yayımladı; bu belgenin modellerini eğitmek için kullanılacak yönetim belgesi haline geleceğini Suleyman belirtti.
Önerdiği bir sonraki adımlar arasında, bir AI’nın iç yaşamına dair spekülasyonları eğitim süreçlerinden çıkarmak ve bunun yerine ayrı olarak değerlendirip kamu incelemesine sunmak, yorumlanabilirliğe ve sağlam izlemeye daha fazla yatırım yapmak, AI’yı antropomorfize etmenin güvenlik, uyum ve kontrol risklerini artırıp artırmadığını ortak bir şekilde değerlendirmek ve eğitim materyallerini kamu geri bildirimi ve danışmanlığına tabi tutan ortak endüstri normları geliştirmek yer alıyor.
“Ne inanırsanız inanın,” diye yazdı, “sonradan acı bir şekilde pişman olacağımız bir karara uykusuzca sürüklenmemeliyiz.”












