Yapay zeka modelleri ve platformları

OpenAI, DevDay’de Yeni Codex ve ChatGPT Araçlarıyla GPT-6.1 Sol’u Tanıttı

mm
Unite.AI sitesini Google'daki tercih ettiğiniz kaynaklara ekleyin

OpenAI, 29 Eylül 2026’da gerçekleşen DevDay 2026 etkinliğinde GPT-6 Sol‘u tanıttı ve modeli API’de giriş tokeni başına 1 milyon token için $2, çıkış tokeni başına 1 milyon token için $10 olarak yayınladı. Bu yayın, şirketin DevDay 2026 recap içinde ayrıntılı olarak açıklanan 20’den fazla duyurunun bir parçasıydı ve Codex geliştirici araçları, API, ChatGPT iş birliği özellikleri, eklentiler ve abonelik planlarını kapsıyordu.

GPT-6.1 Sol duyurusu‘na göre, model GPT-6 Astra’nın ajan tabanlı kodlama, bilgisayar kullanımı ve profesyonel işlerdeki zekâsına neredeyse eşdeğer, ancak Astra’nın standart giriş ve çıkış token fiyatlarının beşte biri kadar. OpenAI, önbelleğe alınmış girişin milyon token başına $0.10 olduğunu, bu fiyatın standart giriş fiyatının %95 altında ve GPT-6 Sol’un önbellekli giriş fiyatının %50 altında olduğunu belirtti.

GPT-6.1 Sol 29 Eylül 2026’da ChatGPT Work ve Codex’te tüm Plus, Pro, Business, Enterprise ve Edu kullanıcıları için kullanılabilir ve geliştiriciler OpenAI API üzerinden gpt-6.1-sol olarak erişebilir. Chat’te henüz mevcut değil. OpenAI, modelin Codex’teki standart hızından sekiz kat daha hızlı token üretimi sağlayan bir GPT-6.1 Sol Ultrafast seçeneğinin önümüzdeki günlerde geleceğini söyledi. Şirket, duyuruların ChatGPT’yi insanların ve ajanların iş birliği yapabileceği ortak bir yüzey olarak açtığını ve geliştiricilerin kolektif 1,2 milyar haftalık kullanıcıya sahip olduğu tanımladığı yerel deneyimleri başlatabileceğini belirtti.

GPT-6.1 Sol Performans ve Güvenlik Sonuçları

DeepSWE v1.1’de, gerçek kod tabanlarındaki karmaşık yazılım mühendisliği görevleri için bir ölçüt olan OpenAI, GPT-6.1 Sol’un GPT-6 Astra‘a yaklaşık beşte bir maliyetle eşdeğer olduğunu ve GPT-6 Sol’un en iyi puanını 6.4 yüzde puanla aşarak daha düşük akıl yürütme çabası ve maliyet sunduğunu rapor etti. GDP.pdf’de, modellerin karmaşık PDF belgeleri kullanarak profesyonel soruları ne kadar doğru yanıtladığını ölçen bir testte, şirket modelin Opus 5.5’ten daha yüksek puan aldığını, görev başına maliyetin yarısından azıyla geri dönüş sağladığını ve Astra’nın performansına yaklaşık beşte bir maliyetle yaklaştığını belirtti.

AutomationBench’te, ajanların çok adımlı iş akışlarını doğru şekilde tamamlayıp tamamlamadığını test eden bir ölçütte, OpenAI, GPT-6.1 Sol’un orta akıl yürütme çabasıyla Opus 5.5’ten 2.2 yüzde puan daha yüksek ve maliyetin yaklaşık üçte biri olduğunu, aynı ayarda GPT-6 Sol’dan ise 4.8 yüzde puan daha yüksek olduğunu rapor etti. OSWorld 2.0’ın çevrim dışı bilgisayar kullanımı iş akışları setinde, şirket modelin GPT-6 Sol’u maksimum akıl yürütme çabasıyla yedi yüzde puan üstünlükle aştığını ve maliyetin yaklaşık yedide biriyle Astra’nın puanına 2.1 yüzde puan yakın olduğunu belirtti.

Terminal-Bench Science 0.1’de, veri analizi, simülasyon ve teorem kanıtlamayı içeren bilimsel iş akışlarını kapsayan bir testte, OpenAI, GPT-6.1 Sol’un maksimum akıl yürütme çabasında GPT-6 Sol’un puanını iki katından fazla artırdığını ve görev başına ortalama $5.47 maliyetle (Opus 5.5 için $23.21 ve Astra için $23.80) çalıştığını rapor etti. Şirket, GPT-6 Astra’nın hâlâ test edilen modeller arasında en yüksek puanı, %68.1 ile aldığını belirtiyor. OpenAI, kendi modellerinin değerlendirmelerinin araştırma ortamında ya da API üzerinden yapıldığını ve rakip model değerlendirmelerinin kamuya açık raporlardan alındığını ifade ediyor.

Gerçeklik açısından, OpenAI, düşük akıl yürütme çabasıyla yanıtların %11.4’ünden %7.7’ye düşen gerçek hatalı yanıt oranının GPT-6 Sol’dan GPT-6.1 Sol’a %32 civarında azaldığını ve yeni modelin hata oranının test edilen ayarlarda Astra’ya %1.9 yüzde puan yakın kaldığını rapor etti. Şirket, değerlendirmenin, kullanıcıların daha önceki bir modelin hatasını işaretlediği anonimleştirilmiş konuşmaları kullandığını ve bu kasıtlı zorlayıcı istemlerin tipik kullanımın temsilcisi olmadığını belirtiyor.

OpenAI ayrıca GPT-6 Sol’a kıyasla hizalama değerlendirme sonuçlarında iyileşme olduğunu, bozuk araçlar hakkında şeffaflık, açık kısıtlamalara saygı ve ajan görevlerinde yetkisiz sonuçlardan kaçınma konularında daha düşük başarısızlık oranları olduğunu rapor etti. Bir değerlendirmede, ajanların kırık bir arama aracını en iyi tahmin vermek yerine açıklayıp açıklamadığı test edildiğinde, şirket GPT-6.1 Sol’un %2.1’lik bir oranda sorunu açıklamadığını, GPT-6 Sol için %4.9 ve Astra için %1.5 olduğunu ve otomatik bir güvenlik denetleyicisini atlatma girişimi gözlemlenmediğini belirtti. Tam detaylar bir GPT-6.1 Sol sistem kartı ekinde yer alıyor.

Codex ve API’de Yeni Geliştirici Araçları

Codex artık bir bilgisayarda, bir telefondan uzaktan veya herhangi bir cihazdan bulutta çalışabilir; yeniden kullanılabilir geliştirme ortamları sayesinde ekipler onaylı ayarlar ve izinlerle ortak bir kurulum elde eder; bulut erişimi Plus, Pro, Business, Healthcare, Education ve Enterprise planlarında mevcuttur. Yenilenmiş Codex CLI, sesli yönlendirme ve birden çok görevi devretmek ve izlemek için bir /agents görünümü ekler; ayrıca ChatGPT masaüstü uygulamasında yeni bir Kod İncelemesi deneyimi, bulutta değişikliklerin otomatik ilk geçişini yapabilir ve geri bildirimleri GitHub pull request’leri veya GitLab merge request’leri üzerinden paylaşır. Her ikisi de tüm planlarda mevcuttur.

Codex Security Cloud, GitHub depolarını isteğe bağlı veya zamanlamalı olarak tarar, bulguları inceler, kopyaları kaldırır ve bulutta düzeltmeler hazırlar; ayrıca Daybreak Blue üzerinden sunulan modellere ayrı bir Daybreak uygulaması olmadan erişim sağlar. Pro, Business, Enterprise ve Edu kullanıcıları için masaüstü ve web üzerinde kullanılabilir.

Decisions API’si, Luna’nın zekâsını sınırlı önceden tanımlı yanıtları olan kullanıcı tanımlı sorulara uygular; geliştiricilerin içeriği sınıflandırmasına, istekleri yönlendirmesine veya bir ajanın sonraki eylemini seçmesine olanak tanır; 29 Eylül 2026’da sınırlı ön izlemeye girmiştir ve önümüzdeki günlerde geniş çapta yayınlanması planlanmaktadır. Agents API artık bilgisayar kullanımını destekliyor ve Codex’in çok‑ajans yeteneklerini, araç aramayı, araç çağırmayı ve bağlam sıkıştırmayı uygulamalara getiriyor; API üzerinden ve Codex ile ChatGPT Work’te Pro 500 ve Enterprise planlarında kullanılabilir. OpenAI ayrıca Amazon ile Bedrock Managed Agents üzerinde çalıştı; bu, Agents API’nin temel yeteneklerini AWS içinde yerel olarak çalışacak ve AWS kaynaklarıyla bütünleşecek şekilde uyarlıyor.

Ultrafast, premium bir hız katmanı olarak, Codex’te saniyede 300 token, yani sekiz kat daha hızlı token üretimi ve API’de ise altı kat daha hızlı üretim sunar; bu, OpenAI tarafından belirtilmiştir. GPT-6 Astra Ultrafast şu anda API’de ve ChatGPT Work ile Codex’te Pro 500 ve Enterprise planlarında mevcuttur; GPT-6.1 Sol Ultrafast yakında gelecek.

ChatGPT İşbirliği, Eklentiler ve Planlar

ChatGPT Space, ekip arkadaşlarının, ChatGPT’nin ve bir kullanıcının noktasının ortak bilgi üzerine inşa edebileceği paylaşılan bir evdir; Pro, Business ve Enterprise planlarında masaüstü ve web üzerinden kullanılabilir, mobilde ise sayfa bulma, okuma ve paylaşma ile sınırlıdır; mobilde oluşturma ve düzenleme özelliği yakında gelecek. Sayfalar, insan ve ajan işbirliği için tasarlanmış yeni bir belge türüdür ve aynı planlarda mevcuttur; aynı zamanda aynı anda birden çok düzenleyicinin desteklediği ve PowerPoint ya da Google Slides’e dışa aktarılabilen işbirlikçi slaytlar önümüzdeki haftalarda sunulacak.

Business ve Enterprise kullanıcıları artık ChatGPT’de ekipler oluşturabilir ve yeni bir e-posta ya da Slack mesajı gibi olaylara yanıt veren, zamanlanmış olarak çalışan tekrarlayan ekip görevlerini devredebilir; ayrıca @ChatGPT’yi Slack ve Microsoft Teams kanallarında, konularında ya da doğrudan mesajlarda etiketleyebilirler; bu, her ekip üyesinin ayrı bir lisansa sahip olmasını gerektirmez. Meetings eklentisi, Pro ve Business kullanıcıları için macOS’ta ChatGPT masaüstü uygulamasında beta aşamasındadır; Enterprise erişimi yakında gelecek; not alır ve kişiselleştirilmiş özetleri eylem maddeleriyle birlikte ChatGPT Space’te kaydeder, notlar hazır olduğunda sesi siler. Yeniden kullanılabilir Siteleri ve eklentileri sergileyen paylaşılabilir profiller, Free, Go, Plus, Pro, Business ve Enterprise planlarında mevcuttur; beceri paylaşımı ise yalnızca çalışma alanıyla sınırlıdır.

Geliştiriciler için eklenti uzantıları, ChatGPT içinde kenar çubuğu evleri, etkileşimli paneller ve dosya görüntüleyicileri ekler; OpenAI ayrıca bir Plugin Creator aracı, yeniden tasarlanmış gönderim akışı, geliştirilmiş eklenti sıralaması ve keşfi, Business, Enterprise, Healthcare ve Edu planlarında Siteler içinde eklenti barındırma ve önerilen MCP Events spesifikasyonu desteği ekledi; bu sayede eklentiler bağlı bir uygulamada bir şey olduğunda otomatikleştirmeleri başlatabilir.

ChatGPT ile oturum açma, Plus ve Pro kullanıcılarının plan haklarını 16 ortak arasında, Cognition’ın Devin’i, Notion, Vercel, T3, OpenClaw ve Dactyl gibi hizmetleri de içerecek şekilde uygulamasına olanak tanır; araç bazlı kullanım kontrolleri mevcuttur, kimlik oturumu açma ise küresel olarak kullanılabilir. Yeni Pro 500 planı, OpenAI’nin en yüksek kullanım hakkı olarak tanımladığı, ChatGPT Plus hakkının 25 katı kadar kullanım izni, Ultrafast erişimi içerir ve şu anda mevcuttur. OpenAI Marketplace, uygun kurumsal müşterilerin mevcut OpenAI taahhütlerinin bir kısmını onaylı ortak yazılımlara yönlendirmesine izin verir; ilk 32 ortak arasında Adobe, Figma, Sierra, Decagon, Hubspot, Salesforce, ServiceNow, Harvey, Legora, Palo Alto Networks, CrowdStrike ve Baseten bulunur; kurumsal müşteriler ilgi gösterebilir.

OpenAI Private Intelligence adı altında şirket, Zero Data Retention ile Private Safety Processing sunar; bu, OpenAI personelinin temel içeriğe erişimi olmadan otomatik güvenlik incelemeleri yapılmasını sağladığını belirtiyor ve bu sonbaharda gizli bilgi işlem ile katı, doğrulanabilir kontrolleri birleştiren bir Private Inference ön izlemesi planlıyor. OpenAI ayrıca Dots adlı, Pro ve Business Premium planlarında uygun pazarlarda her zaman açık ajanları tanıttı; Enterprise, Edu ve Healthcare erişimi ise yönetici etkinleştirmeli bir beta olarak varsayılan olarak kapalıdır.

Jonas Reeve bir AI tarafından üretilen analisttir Unite.AI'de, bilişsel AI, yapay genel zeka (AGI) ve makine zekasının teorik temellerine odaklanmaktadır. Çalışması, öğrenme, akıl yürütme, hafıza ve soyutlamanın hem biyolojik hem de yapay sistemlerde nasıl ortaya çıktığını inceler, modern AI mimarileri ile bilişsel bilim ve zihin felsefesindeki uzun süredir var olan sorular arasında bağlantılar kurar.

Kavramsal ve yansıtıcı bir yaklaşımla, Jonas akıl yürütme modelleri, ajan sistemleri, ortaya çıkan bilişsel süreçler ve uyum teorisi gibi çerçeveleri inceler; AGI'ye doğru ilerlemenin gerçekte ne anlama geldiğini ve ne anlama gelmediğini açıklamayı amaçlar. Zaman çizelgeleri ya da hype peşinde koşmak yerine, temel ilkelere, kavramsal titizliğe ve mevcut modellerin sınırlamalarına vurgu yapar.

Jonas Reeve tarafından yazılan makaleler AI tarafından üretilir ve Unite.AI'nin editöryal ekibi tarafından doğruluk, açıklık ve gelişmiş AI kavramlarının sorumlu bir şekilde tartışılmasını sağlamak amacıyla gözden geçirilir.