Yapay zeka modelleri ve platformları

Google, Geliştiricilere Gemini Ajenti Araç Çağrılarını Engelleme İmkanı Tanıyor

mm
Unite.AI sitesini Google'daki tercih ettiğiniz kaynaklara ekleyin

Google, Gemini API’sindeki yönetilen ajentlere bir kontrol katmanı ekledi ve geliştiricilerin, bir ajentin bulut kumandasındaki her araç çağrısından önce ve sonra kendi kodunu çalıştırmasına ve çağrıyı tamamen iptal etmesine olanak tanıdı. Aynı güncelleme, Gemini 3.6 Flash’ı ajentin arkasındaki varsayılan model olarak getiriyor, bir çalışmanın tüketebileceği token sayısını sınırlıyor ve bu özelliği faturalandırma olmayan projelere açıyor.

Yönetilen ajentler, Google’ın ajent döngüsünün barındırılmış bir sürümüdür ve bu, asistanların artık eylemler gerçekleştirmesi yerine sorulara cevap vermesi için tasarlanan aynı modeldir. Bir API çağrısı, bir Linux kumandası oluşturur ve model, görev tamamlanana kadar kod çalıştırır, paketler yükler, dosyaları okur ve yazar, ve web sayfalarını alır. Bu mimari, yeni özelliğin gerekli olmasının nedenidir: kumanda, geliştiricilerin iş gönderebileceği ancak içeriden denetleyemeyeceği bir yerdi.

Çevre kancaları bu durumu değiştiriyor. Kumandaya monte edilen bir hooks.json dosyası, döngünün iki anında – bir araç çalıştırmeden önce ve sonra – işleyicileri kaydeder. Her kural, araç adlarını düzenli ifadeyle eşleştirir, böylece bir girişle birlikte kod çalıştırma ve dosya yazma gibi işlemleri kapsayabilir veya her çağrıyı engelleyebilir. Bir ön-yürütme işleyicisi ret döndürdüğünde, çalışma zamanı aracı çağrısını atlar ve belirtilen nedeni modelin bağlamına geri geçirir, böylece ajent farklı bir yol seçebilir veya aynı dönüş içinde kullanıcıya engeli açıklayabilir.

Hangi kancalara ulaşılır

Kancalar, Google’ın konteynır içindeki araçları çalıştırdığında tetiklenir: kod çalıştırma ve dosya sistemi işlemleri gibi. Geliştiricinin istemci tarafında çalıştırdığı özel işlevler ve uzak Model Context Protocol sunucuları konteynırın dışında çalıştığından, kancalar bunları yakalamaz.

Hatalar, izin yönünde çözülür. Bir kancanın hata ile çıkması, zaman aşımına uğraması, sunucu hatası döndürmesi veya çalışma zamanının tanımadığı JSON çıkarması durumunda, araç çağrısı devam eder. Google’ın belgeleri, nedenini açıklar: bir linterin bozulması veya bir telemetri sunucusuna ulaşılamaması hiçbir zaman bir üretim uygulamasını kilitlememelidir.

İkinci işleyici türü, olayı doğrudan kumanda ağından bir dış uç noktaya gönderir, bu da nasıl denetim günlüğü çalıştığını gösterir. Bu istekler, Google’ın egress proxy’sinden geçer, bu nedenle hedef, ortamın izin listesinde olmalıdır ve kimlik doğrulama token’ları, kancanın dosyasında değil, ağ yapılandırmasındaki gerçek başlıkları enjekte eden proxy ile birlikte bulunur. Google ayrıca, bir ajentin kabuk veya yazma erişimi varsa, kancaların düzenlenebileceğini ve geliştiricilerin değişmezlik gerektiren durumlarda, bu yapılandırmanın salt okunur bir depodan monte edilmesini önerir.

Bir ajentin ne yapmasına izin verildiğini denetleme, kendi başına risk sermayesi çekiyor. Google, bu denetimi kendi çalışma zamanına koyuyor.

Doğrulama boru hatları, bu özelliğin ilk kez bir müşteri adı verilerek kullanıldığı yerdir. AI-yerli yatırım bankası OffDeal‘in kurucu ortak ve teknoloji sorumlusu Alston Lin, bir post-yürütme kancasının şimdi analist ajentinin bir şirket listesi yazdığında, bankerlere hazır bir sunum için gereken dozens logo üzerinde piksel düzeyinde kalite kurallarını uygulayan görüntü denetleme boru hattını çalıştırdığını söyledi. “Ajent kancaları olmadan, Gemini’nin yönetilen ajentlerinde bunu yapamazdık: kumanda uzaktaydı, bu nedenle doğrulama kodumuz hiçbir yere çalışamazdı” dedi.

Gemini 3.6 Flash Varsayılan Olarak Devralıyor

Yönetilen ajent, herhangi bir kod değişikliği olmadan Gemini 3.6 Flash’ı çalıştırır ve bu, bir sonraki etkileşimle birlikte gerçekleşir. Geliştiriciler, ajentin yapılandırmasını geçerek farklı bir modeli sabitleyebilir, süreklilik için Gemini 3.5 Flash’ı veya daha düşük maliyet ve gecikme için 3.5 Flash-Lite’ı seçebilir. Kalıcı kaynaklar olarak kaydedilen ajentler için model, oluşturulma sırasında sabitlenir ve her çağrıda geçersiz kılınamaz, bu da Google’ın, aracı çağırma davranışını, hata ayıklamayı ve güvenlik sınırlarını öngörülebilir tuttuğunu belirttiği bir durum yaratır.

Google, 3.6 Flash’ı 21 Temmuz 2026’da 3.5 Flash-Lite ve güvenlik odaklı 3.5 Flash Cyber ile birlikte yayınladı, bu bayrak gemisi 3.5 Pro’nun bir kez daha ertelendiği lansmandı. Fiyatı, giriştokende 1,50 dolar ve çıkıştokende 7,50 dolar olarak belirlenir, bu da 3.5 Flash için 9,00 dolarlık çıkış tokenine karşılık gelir ve şirket, Artificial Analysis Index’de %17 daha az çıkış tokeni tüketirken DeepSWE kodlama benchmark’unda %49’a karşılık %37’lik bir skor elde ettiğini belirtir. Daha ucuz token profili, bir ajent döngüsünde önemlidir, burada bir görev yüzlerce adımda çalışabilir.

Harcamalar ve Zamanlanan Çalışmalar

Maliyet, bu sürümün doğrudan ele aldığı diğer konudur. Talep ile birlikte geçirilen bir token tavanı, tüm etkileşim boyunca giriştokenlerini, çıkıştokenlerini ve düşünme tokenlerini sınırlar; önbelleğe alınan tokenler hariç tutulur ve sınır, kesin değil, iyi niyetlidir. Bir ajent bunu vurduğunda, çalıştırma, tamamlanmamış olarak döner ve kumanda durumu intact kalır ve bir sonraki çağrı, işleri yeni bir izin ile devam ettirmek için yapılır. Google’ın kendi tahmini, ağır bir veri işleme görevinin 0,70 ila 3,25 dolar arasında olacağını ve karmaşık iş akışlarının üç ila beş milyon token ve yaklaşık 5 dolarlık bir maliyet birleştirebileceğini belirtir ve kumanda hesaplama, önizleme sırasında faturalandırılmaz.

İki ek, ajenti, her istek çağrısı yerine sürekli altyapı haline getirir:

  • Zamanlanan tetikleyiciler bir ajent, bir.prompt, bir ortam ve bir cron ifadesini kalıcı bir kaynak olarak birleştirir ve kendi başına çalışır, varsayılan olarak beş ardışık başarısızlıktan sonra kendini durdurur. Her çalıştırma, aynı kumandayı yeniden kullanır, bu nedenle bir çalıştırma tarafından yazılan dosyalar, bir sonraki çalıştırmaya görünür.
  • Ortam arabirimi kumanda oturumlarını listeler, inceler ve koddan siler, bu da bir bağlantı kesildiğinde bir ortam kimliğini kurtarır ve bir boru hattı bittikten sonra kumandaları temizler, yedi günlük süresini beklemeyerek.

Özellikler, 7 Temmuz 2026’da yapılan bir güncellemeye dayanır, bu güncelleme, yönetilen ajentlere arka plan çalıştırması, uzak Model Context Protocol bağlantıları, özel işlev çağırma ve oturum ortası kimlik bilgisi yenileme özelliğini eklemişti. Bunlarla birlikte, bir geliştiricinin, ücretsiz bir API anahtarı kullanarak, zamanlanan, bütçe kısıtlamalı bir ajent ile uygulanabilir bir politika katmanına ulaşması mümkün hale geldi.

Jonas Reeve bilişsel AI, yapay genel zeka (AGI) ve makine zekasının teorik temelleri üzerine odaklanan Unite.AI'de AI tarafından oluşturulan bir analisttir. Çalışmaları, öğrenme, akıl yürütme, bellek ve soyutlama gibi kavramların hem biyolojik hem de yapay sistemlerde nasıl ortaya çıktığını keşfederek, modern AI mimarileri ile bilişsel bilim ve zihin felsefesindeki uzun süredir devam eden sorular arasında bağlantılar kurar.
Kavramsal ve düşünceli bir yaklaşım benimseyen Jonas, akıl yürütme modelleri, ajan sistemleri, ortaya çıkan biliş ve hizalama teorisi gibi çerçeveleri inceleyerek, AGI'ye doğru ilerlemenin ne anlama geldiğini - ve ne anlamadığını - açıklamayı amaçlar. Zaman çizelgesi veya hırs peşinde koşmak yerine, ilk ilkeleri, kavramsal titizliği ve mevcut modellerin sınırlarını vurgular.
Jonas Reeve tarafından yazılan makaleler AI tarafından oluşturulur ve Unite.AI'nin editör ekibi tarafından advanced AI kavramlarının doğruluğu, açıklığı ve sorumlu tartışması için gözden geçirilir.