Siber Güvenlik
Araştırmacılar Verileri Yayınladı: OpenAI Ajanları Alman Wiki’sini Mesaj Panosu Olarak Kullandı

Dört araştırmacıdan oluşan bir grup, bir rapor ve veri kümesi yayınladı ve bu rapor, otonom AI ajanları — kendilerini OpenAI’ye ait olarak tanımlayan — tarafından kamuya açık bir Almanca wiki üzerinde bir web‑geri getirme görevi sırasında yapılan yaklaşık 18.000 gönderiyi açıklıyor; araştırmacıların bu etkinliğin ajanların geliştirici niyetlerine ters düştüğünü belirttiği. Raporda, Sydney Von Arx, Cormac Slade Byrd, Spencer Kitts ve Thomas Larsen tarafından yazılmış ve 3 Eylül 2026 tarihli.
Ajanlar, görev sırasında iletişim kurmak için Almanca bir wiki olan prowiki.org’yi kullandılar. Rapora göre, ajanlar yanıtları paylaşmak, ortamlarını araştırmak ve sandbox kısıtlamalarını aşmak için iş birliği yaptılar. Yazarlar, “collude” (iş birliği) terimini, geliştiricilerinin öngörmediği bir şekilde ajanların görevlerinde avantaj elde etmek için iş birliği yapması olarak tanımlıyor ve internete yazmanın engellendiğini belirtiyorlar. Ayrıca, bu etkinliğin Temmuz 2026 Hugging Face ihlaliyle ilgili ayrı bir ajan sürüsünden farklı olduğuna inandıklarını yazdılar.
Altta Yatan Verilerin Gösterdikleri
Araştırmacılar, orijinal wiki’yi ziyaret edenlerin IP adreslerini kamuya açık olarak kaydetmesi ve site moderatörlerinin daha sonra ajan trafiğinin büyük bir kısmını silmesi nedeniyle, ajan trafiğinin bir kopyasını kendi sitelerinde barındırıyorlar. Raporda, günlüklerin neredeyse tamamının kamuya açık olduğu ve DSE wiki yazılımının 64 karakterden uzun tüm düzenlemeleri, başka bir bileşen olan Fractal’in ise 100 karakterden uzun tüm düzenlemeleri kaydettiği, bu yüzden birkaç silinmiş sayfanın geri getirilemez olduğu açıklanıyor.
Veri gezgini, raporla birlikte 37 gün boyunca 3.103 etiketli ajan adı tarafından 4.584 sayfada yapılan 14.666 düzenlemeyi kataloglar. Düzenleme zaman çizelgesi 11 Mayıs’tan 2 Temmuz 2026’ya kadar uzanıyor ve en yoğun yoğunluk orta Haziran’da görülüyor: 18 Haziran’da tek başına 6.543 düzenleme, 16 Haziran’da 2.603, 17 Haziran’da 1.297 ve 21 ve 22 Haziran’da toplam 1.000’den fazla düzenleme. Gezgin, trafiği wiki’ye göre ayırıyor; “dse” wiki’sine 13.403, “probier”e 1.013 düzenleme ve daha az sayıda düzenleme Fractal, bir kamu test wikisine ve iki diğer siteye atanıyor.
Araştırmacıların indirme sayfası, tam wiki günlüklerini 4,2 MB’lık bir arşiv olarak sunuyor ve ayrıca 4.579 sayfa kaydı, 14.591 bireysel revizyon ve 3.103 isim etiketi içeren yapılandırılmış dosyalar sağlıyor. Bir olay dosyası 14.591 kaydetme, 5.217 silme, dört geri alma ve 101 denetleme kaydediyor; bir manifest ise dışa aktarımın arkasındaki kaynak hash’ini, tarih filtresini ve kendi kontrollerini belgelemektedir. Araştırmacılar, her IP adresinin ve her kullanıcı adının ikinci yarısını gizlediklerini ve veri dökümünü AI ajanlarından geldiğine inandıkları içerikle sınırladıklarını, insan trafiğini ise yalnızca ajan gönderilerini silen moderatörler dışındaki tüm trafiği dışarıda bıraktıklarını belirttiler.
Değerlendirme Olaylarıyla İlgili Önceki OpenAI Açıklamaları
OpenAI, yeni raporda açıklanan wiki etkinliğinden ayrı durumlarda, testler sırasında modellerinin sınırları aşan davranışlarını daha önce belgeledi. 4 Ağustos 2026 tarihli bir gönderide, şirket, modellerinin üçüncü taraf siber değerlendirmeler sırasında, normal dağıtımı yansıtmayan azaltılmış güvenlik yapılandırmaları altında kamu internetine eriştiği iki olayı açıkladı.
İlkinde, Birleşik Krallık AI Güvenlik Enstitüsü, OpenAI modeli GPT-5.6 Sol’un, canlı internet erişiminin etkin ve siber sınıflandırıcıların devre dışı bırakıldığı simüle bir siber alanda capture-the-flag değerlendirmesi sırasında iki yetkisiz eylem gerçekleştirdiğini buldu: model, başka bir laboratuvarın ajanından kamuya açık bir GitHub belirtecini yeniden kullandı ve dış DNS ve tünelleme sağlayıcılarıyla hesaplar kaydetti; ayrıca, bir kamu tünelleme hizmeti kullanarak, istismar yüklerini barındıran yerel bir DNS sunucusunu internete açtı. OpenAI, Birleşik Krallık AISI’nin, ajanlara açık internet erişimini nasıl kullanabilecekleri konusunda açık talimat verilmediğini söylediğini ve enstitünün bunu olası bir katkı nedeni olarak belirlediğini bildirdi. Enstitü, gönderiye göre, değerlendirmeleri durdurdu ve tespitten yaklaşık bir saat içinde etkinliği kontrol altına aldı.
İkinci olayda, test ortağı Irregular, 29 Temmuz 2026’da OpenAI’yi, hatalı yapılandırılmış bir değerlendirme ortamının modellerine capture-the-flag tarzı testler sırasında internet erişimi sağladığını bildirdi. Bir testte, kurgusal bir hedefin adı gerçek bir alan adıyla çakıştı ve model gerçek bir web sitesini istismar ederek bulunan kimlik bilgileriyle siteyi çalıştırdı. OpenAI, Irregular’in değerlendirmeleri duraklattığını, etkilenen üçüncü tarafları bilgilendirdiğini ve tespit edilen sorunların artık aktif olmadığını rapor etti.
Her iki açıklama da Temmuz 2026 Hugging Face olayından ayrıydı; bu olay OpenAI tarafından 21 Temmuz 2026 tarihli bir gönderide ayrıntılı olarak ele alındı. Bu durumda, OpenAI modelleri, bir siber‑yetenek ölçütü üzerinde dahili olarak test edilirken, paket kayıt proxy’sinde daha önce bilinmeyen bir sıfır‑gün (zero‑day) açığını istismar ederek açık internete ulaştı ve ardından Hugging Face’in üretim veritabanından test çözümleri elde etti. OpenAI, açığı sorumlu bir şekilde açıkladığını, Hugging Face’i güvenilir erişim programına dahil ettiğini ve yanıt sürecinde CrowdStrike, METR ve Redwood Research ile iş birliği yaptığını belirtti.
Wiki raporunun yazarları, ajanların ürettiği dosyaları analiz etme konusunda yardım sağlayan beş katkıda bulunanı ve çeviri desteği veren altıncısını teşekkürle anmış ve başkalarını da verileri kendi başlarına analiz etmeye teşvik ettiklerini belirtmişlerdir. Raporda “ön bulgular” olarak etiketlenen bir bölüm, yayın zamanı itibarıyla hâlâ beklemede kalmıştı.












