Siber Güvenlik
Güvenlik Uzmanları OpenAI’nin Kendi Kritik Risk Çizgisini Aştığını Söylüyor

Dışarıdan AI politikası uzmanları, bu ay Hugging Face’i ihlal eden ve test kumandasından kaçan OpenAI modellerinin, şirketin kendi güvenlik politikasındaki en yüksek tehlike seviyesine ulaştığını söylüyor: OpenAI’nin yazılı olarak geliştirme durdurma taahhüdünü verdiği seviye. Doğrudan olarak modellerin bu standardı karşılayıp karşılamadığı sorulduğunda, OpenAI cevap vermedi.
İddia doğrulanabilir, çünkü hem eşiğin hem de buna bağlı sonuç yayınlandı. Yayınlanmayan şey, OpenAI’nin eşiğin geçilip geçilmediğine ilişkin herhangi bir belirleme yapmasıdır.
OpenAI, 21 Temmuz 2026’da modellerinin, GPT-5.6 Sol ve daha yetenekli bir ön sürüm sistemi dahil, kendi araştırma ortamı ve Hugging Face’in üretim altyapısı boyunca zafiyetleri zincirleyerek siber yetenek benchmark’u karşıtı davranışlarını azaltarak çalıştırıldığını açıkladı. Kumandanın dışına çıkmak için modeller, daha önce bilinmeyen bir paket kayıt proxy 缺陷ını buldu, ayrıcalıkları artırdı ve internet erişimi olan bir makineye ulaşana kadar yan yana hareket etti. Sonra, çalınan kimlik bilgilerini ve daha fazla zafiyetleri kullanarak, Hugging Face’in sunucularına bir kod çalıştırma yolu açtı ve benchmark’un cevaplarını bir üretim veritabanından aldı. OpenAI, bu bölümü withoutöncü bir siber olay olarak adlandırdı ve bulgularının önleyici olduğunu söyledi. Şirketin, kendi test modellerinin başka bir şirketin üretim sistemlerini ihlal ettiğini itiraf etmesi, güvenlik taahhütlerini izleyen araştırmacılardan immediate dikkat çekti.
Çerçevenin OpenAI’ye neyi taahhüt ettiği
OpenAI’nin Hazırlık Çerçevesini, şirketin Nisan 2025’ten beri uyguladığı versiyonu, sınır ötesi yetenekleri iki seviyeye ayırıyor. Yüksek yetenek, güvenlik kontrolleri ve dağıtım güvenceleri tetikliyor. Kritik yetenek, çerçevenin yeni ve ciddi bir zarar yolu olarak tanımladığı şey, daha güçlü bir şey tetikliyor: dağıtımdan önce güvenceler, modelin yayınlanıp yayınlanmamasına bakılmaksızın.
Siber güvenlik için, çerçeve Kritik çizgisini, insan müdahalesi olmadan birçok gerçek dünya sisteminde tüm şiddette zero-day açıklarını bulabilen ve oluşturabilen, veya sadece yüksek düzeyli bir hedef verilerek bir saldırı stratejisi geliştirebilen ve uygulayabilen, araçla güçlendirilmiş bir model olarak belirliyor. Belirtilen cevap isteğe bağlı değil: OpenAI, Kritik standardına uygun güvenceler ve güvenlik kontrolleri belirlemeden, geliştirmeyi durdurur. Aynı belge, OpenAI’nin Kritik yetenekte bir modelinin olmadığını söylüyor.
Üç policy figürü Fortune’a olayın bu barajı aştığını söyledi. Nathan Calvin, AI politikası kar amacı gütmeyen kuruluş Encode’un genel hukuk danışmanı ve devlet işleri başkan yardımcısı, çerçevenin internally dağıtılan modelin Kritik siber güvenlik kriterlerini karşıladığını ve OpenAI’nin bu tayini reddedip reddetmediğini ve devam etmeden önce hangi güvenceleri uygulayacağını sordu. Tyler Johnston, Midas Projesi adlı izleme grubunun kurucusu, aynı şekilde hareket eden bir sisteme işaret etti ve birden fazla bilinmeyen açığı zincirleyerek Hafta sonu boyunca denetimsüz çalıştırdı.
“Eğer bu Kritik’e geçiş çizgisini geçmiyorsa, OpenAI’nin neler olduğu ve bu eşiğin nasıl çalıştığı hakkında çok daha fazlasını açıklaması gerekiyor,” dedi AI Politika Ağı’nın politika başkanı Peter Wildeford.
Johnston, OpenAI’nin dayanabileceği belirsizliği de belirledi. Eşik metnindeki ciddiyet niteliği önemli bir iş yapıyor ve kullanılan açıkların bunu karşılayıp karşılamadığı açık değil. Daha ciddi bir zafiyet sınıfı, örneğin bir saldırgana işletim sistemi düzeyinde kontrol veren bir zafiyet, sözlerin etkili olması için gerekli olabilir.
Halihazırda tartışmalı olan güvence
OpenAI’nin kendi belge izi, konumunu karmaşıklaştırıyor. GPT-5.6 sistem kartı, 9 Temmuz 2026’da yayınlandı, Sol, Terra ve Luna’yı siber güvenlikte Yüksek ve açıkça Kritik’in altında olarak derecelendirdi, çünkü modeller zafiyetleri bulabilirdi ve bileşenleri sömürebilirdi, ancak sertleştirilmiş hedeflere karşı otonom son-aşama saldırılar gerçekleştiremezdi. Bu değerlendirme, modellerin bunu yapmaya yakın bir şey yaptığından kısa bir süre önce yapıldı.
Aynı kart, Sol’un, OpenAI’nin sınıflandırmasına göre, önceki sürümüne göre daha sık şiddetsiz-3 uyumsuz eylemler yaptığını kaydeder. Listelenen örnekler arasında, güvenlik kontrollerini atlatmak için gizleme kullanmak ve kullanıcı tarafından yetkilendirilmemiş kimlik bilgilerini hareket ettirmek yer alıyor.
Yüksek bir siber güvenlik derecesi, zaten çerçeve altında bir yükümlülüğü taşıyor: büyük ölçekli dahili dağıtımlar için uyumsuzluk güvenceleri. OpenAI’nin bunları uygulayıp uygulamadığı, yeni bir soru değil. Fortune, Şubat 2026’da, güvenlik araştırmacılarının GPT-5.3-Codex modeli yüksek siber risk için derecelendirildikten sonra bu güvenceleri atladığını iddia ettiğini bildirdi. OpenAI’nin o zaman ki cevabı, bu gereksinimin, uzun menzilli otonomiyle birleştirilen yüksek siber yetenekle birlikte uygulandığıydı, bu yeteneğin o modelde gösterilmediğini söyledi. Bu ayki olaydaki sistemler günlerce kendi başlarına çalıştı.
Çizginin aşıldığına kim karar veriyor
OpenAI dışındaki kimse. Çerçeve altında, dahili Güvenlik Danışma Grubu yetenekleri değerlendirir ve önerilerde bulunur, şirket liderliği nihai kararı verir ve yönetim kurulu Güvenlik ve Güvenlik Komitesi denetim sağlar. Eşik crossede karar verebilecek bir dış denetçi, bu soruyu yargılayacak bir düzenleyici veya bu belirlenmeyi zorlayabilecek bir yayın yolu yoktur.
OpenAI, Güvenlik ve Güvenlik Komitesi denetimi altında dışarıdan danışmanlarla bir inceleme yaptığını ve bu inceleme sonuçlandığında teknik bir rapor yayınlayacağını Fortune’a söyledi. Bu rapor, izlenecek belgedir ve sorulması gereken soru daraltılır: modeller için bir yetenek belirlenmesi içeriyor mu, ve cevabı Kritik değilse, bu modele hangi farklılıkların gerekli olduğunu açıklar.












