Düzenleme

OpenAI’nin en iyi modeli şimdi bir hükümet kapısı arkasında gönderildi

mm
Unite.AI sitesini Google'daki tercih ettiğiniz kaynaklara ekleyin

OpenAI, 26 Haziran 2026’da GPT-5.6 Sol‘u ön izleme olarak yayınladı ve teknik özellikleri itibariyle şirketin şimdiye kadarki en güçlü modelinin lansmanını beklediğiniz gibi gerçekleştirdi. Sol, amiral gemisi modeldir ve altında Terra ve Luna olmak üzere iki kardeş modeli vardır. Terra, OpenAI’nin GPT-5.5 ile aynı performansı sunarken yarı fiyatına sunulan dengeli bir modeldir. Luna ise ucuz ve hızlı bir modeldir.

Yeni bir max akıl yürütme ayarı, modele daha fazla düşünme alanı sağlar ve ultra modu, uzun işleri çözmek için alt ajanları çalıştırır. Terminal-Bench 2.1 için komut satırı işlerinde yeni bir durum yaratır, genetik benchmark’lerde tokenleri daha az kullanarak kazançlar sağlar ve uzun vadeli siber güvenlik görevlerinde sınırı ilerletir.

Ekran görüntüleri için bu kısım önemlidir. Ancak önemli olan kısım bu değildir.

Önemli olan kısım, benchmark’lerin altında gömülü bir paragrafta yer alıyor: Sol’u aslında kullanamazsınız. Henüz değil ve sunucuların ısınması nedeniyle değil. OpenAI, Sol, Terra ve Luna’yı “küçük bir grup güvenilir ortak için sınırlı ön izleme” olarak başlattı ve bu ortakların katılımı hükümetle paylaşıldı.

OpenAI’nin kendi sözleriyle, bu durum ABD hükümetine modellerin ve yeteneklerinin ön izlenmesinden sonra gerçekleşti ve hükümet bu şekilde sunulmasını istedi. Bir sınır modeli piyasaya sürüldü ve ilk geçtiği kapı bir hız sınırı değildi. Washington’du.

Erişim artık bir politika değişkenidir

Gerçek işi bu modeller üzerinde gerçekleştiren herkes için bu, manşettir ve (biraz) yeni bir durum. API’ye dayalı olarak çalışan her operatör, belirli riskleri içselleştirmiştir. Fiyat değişiklikleri, lansman sırasında hız sınırlamaları, bir modelin kullanımdan kaldırılması veMigration için çabalama, bir yeteneğin sessiz bir güncellemeyle zayıflatılması. Bunları, binaların altyapısı üzerinde inşa etmekle ilgili hava koşulları olarak planlarsınız.

Planlamadığınız şey, erişimin federal hükümet tarafından onaylanmasıdır. Bu, risk modelindeki yeni satır. Sol var. Sınırda benchmark yapıyor. Ve onu kullanıp kullanamayacağınız, artık kredi kartınıza değil, Yönetim’in gördüğü bir listedeki bir fonksiyon.

OpenAI’nin bunu böyle okuduğu açık, çünkü bunu uzun vadeli bir hükümet erişim süreci olmasını istemediklerini söyleyerek bir paragraf uzaklaştırdı: “Bu tür bir hükümet erişim sürecinin uzun vadeli varsayılan haline gelmesini istemiyoruz. Bu, en iyi araçları kullanıcılardan, geliştiricilerden, şirketlerden, siber savunuculardan ve küresel ortaklardan uzaklaştırır.”

Kapıyı, geniş erişimi daha hızlı elde etmek için kısa vadeli bir hareket olarak tanımlar ve bunu, 2 Haziran’da yayımlanan bir yürütme emri ile bağlar — aynı politika itmesi, laboratuvarların yamayı, sadece hatayı değil, sahip olmak için yarışmasını sağlar.

Bu emir gerçek ve dikkatlice okunmaya değer — sınırlı ön modelsel siber inceleme kararı verir ve geliştiricilere, daha geniş bir sürümden önce hükümete 30 gün erken erişim izni verir. Ayrıca, AI modellerinin yayınlanması için zorunlu bir hükümet lisansı, ön onay veya izin gerektirmediğini belirtir.

Şimdi burada bir boşluk var. Emir, zorunlu ön onay olmadığını söylüyor. Lansman, hükümetin talebi üzerine sıralanmış bir ön izleme ve hükümetin gördüğü bir ortak listesi. Kağıt üzerinde gönüllü.

Pratikte, ülkenin en yetenekli laboratuvarlarından biri, en güçlü modelinin lansmanını, dışarıdaki herkesin erişebilmesinden önce hükümetin kontrolünden geçirerek gerçekleştirdiğinde, bu, emrin metninin zorunlu bir ön onay olmadığını söylemesine rağmen, gerçek zamanda oluşan varsayılan haline dönüşür.

Bu kalıbı daha önce ve yakın zamanda gördük

Bu durum, altı ay önce olabileceğinden daha sert bir şekilde etkiliyor: Anthropic, ihracat kontrolü versiyonunu zaten yaşadı ve aynı noktayı daha sert bir şekilde kanıtladı. Bu ayın başlarında hükümet, Anthropic’in en güçlü modelleri Fable 5 ve Mythos 5’e herhangi bir yabancı uyruklu kişi tarafından erişimi askıya alan bir yönerge yayımladı.

Bir laboratuvarın en güçlü modelleri, bir yönergeyle yabancı uyruklular için engellenir. Şimdi diğer sınır laboratuvarı, en güçlü modelini hükümetin talebi üzerine bir ön izleme olarak piyasaya sürüyor. Yılın en önemli üç model lansmanından ikisi, aynı el tarafından, birbirini izleyen haftalarda engellenir.

Bu sistemi inşa ediyorsanız, bunu Washington hikayesi olarak göremeyiniz. Bu, bir bağımlılık hikayesidir. Yetenek sınırı ve erişim sınırı ayrılmıştır — bir model dünya çapında en iyisi olabilir ve aynı zamanda çalıştırma izninize sahip olmadığınız bir şey olabilir.

Sol bunun kanıtıdır. Fable 5 bunun kanıtıdır.

Benchmark’ler “kullan beni” der. Erişim bölümü “hükümete sor” der. Her ikisi de aynı anda doğrudur ve bu kombinasyon, bu laboratuvarların akışındaki insanlar için gerçekten yeni.

Bir operatör gerçekten ne yaparsa yapsın, panik değildir ve düzenleme hakkında bir yorum değildir. Aynı sıkıcı disiplin, model değişikliğinden etkilenen kişilerle etkilenmeyenleri her zaman ayırmıştır: operasyonunuzu bir laboratuvarın tek sınır modeline sabitlemeyin.

Sol’un engellenmesi, Terra’ya, GPT-5.5’e veya başka bir sağlayıcıya geri dönebilen bir sistemi bozmaz, çünkü sistem baştan beri bir modelin erişilebilirliğine tümünü bağlamamıştır. Laboratuvarlar, “erişilebilirlik” kavramını sizin hiç konuşmayacağınız kişiler tarafından ayarlanabilen bir değişken haline getirdi.

Zaten model katmanını değiştirilebilir altyapı olarak gören operatörler bunu atlatabilir. Bir uç noktaya tüm ürününü inşa edenler ise o uç noktanın gerçek maliyetini öğrenmiştir.

Alex McFarland yapay zeka muhabiri ve yazarıdır ve yapay zekadaki son gelişmeleri araştırıyor. Birçok yapay zeka başlangıç şirketi ve dünya çapındaki yayınlarda işbirliği yaptı.