Model dan platform AI

Google Izinkan Pengembang Memblokir Panggilan Alat Agen Gemini

mm
Tambahkan Unite.AI ke sumber pilihan Anda di Google

Google telah menambahkan lapisan kontrol ke agen yang dikelola di Gemini API, memungkinkan pengembang untuk menjalankan kode mereka sendiri sebelum dan setelah setiap panggilan alat yang dilakukan oleh agen di dalam sandbox cloud, dan membatalkan panggilan tersebut secara langsung. Pembaruan yang sama membuat Gemini 3.6 Flash menjadi model default di balik agen, membatasi jumlah token yang dapat dikonsumsi oleh satu jalankan, dan membuka fitur ini untuk proyek dengan tidak ada penagihan yang terlampir.

Agen yang dikelola adalah versi hosting Google dari loop agen, pola yang sama di balik asisten yang sekarang sedang dihubungkan untuk melakukan tindakan daripada menjawab pertanyaan. Satu panggilan API menyediakan sandbox Linux, dan model kemudian merencanakan, menjalankan kode, menginstal paket, membaca dan menulis file, dan mengambil halaman web sampai tugas selesai. Arsitektur itu adalah apa yang membuat fitur baru ini diperlukan: sandbox adalah tempat pengembang dapat mengirimkan pekerjaan ke dalamnya tetapi tidak dapat memolisinya dari dalam.

Hook lingkungan mengubah itu. File hooks.json yang dipasang ke dalam sandbox mendaftarkan handler terhadap dua momen dalam loop, sebelum alat dijalankan dan setelah selesai. Setiap aturan cocok dengan nama alat dengan ekspresi reguler, sehingga satu entri dapat mencakup eksekusi kode dan penulisan file bersama atau menangkap setiap panggilan. Ketika handler pra-eksekusi mengembalikan penolakan, runtime melewatkan panggilan alat dan mengirimkan alasan yang dinyatakan kembali ke konteks model, di mana agen dapat memilih rute yang berbeda atau menjelaskan blokir kepada pengguna di dalam giliran yang sama.

Apa yang hook capai

Hook diaktifkan pada alat yang Google jalankan di dalam kontainer: eksekusi kode, plus operasi filesystem yang membaca, menulis, daftar dan menghapus file. Fungsi kustom yang dijalankan pengembang di sisi klien dan server Model Context Protocol yang berjalan di luar kontainer, sehingga hook tidak menangkap mereka.

Kegagalan diselesaikan menuju izin. Jika skrip hook keluar dengan kesalahan, waktu habis, mengembalikan kesalahan server, atau mengeluarkan JSON yang runtime tidak mengenali, panggilan alat dilanjutkan. Dokumentasi Google memberikan alasan: linter yang rusak atau server telemetri yang tidak dapat dijangkau tidak pernah harus dapat mengunci aplikasi produksi.

Jenis handler kedua memposting acara langsung ke endpoint eksternal dari dalam jaringan sandbox, yang merupakan cara kerja logging audit. Permintaan tersebut melakukan perjalanan melalui proxy egress Google, sehingga tujuan harus duduk di allowlist lingkungan, dan token autentikasi hidup di konfigurasi jaringan daripada di file hook, dengan proxy menyuntikkan header nyata di kawat. Google juga mencatat bahwa agen yang memegang akses shell atau tulis dapat mengedit file hook di ruang kerja yang dapat ditulis, dan menunjuk pengembang yang memerlukan ketahanan tamper untuk memasang konfigurasi dari repository yang hanya-baca.

Mengawasi apa yang agen diizinkan untuk dilakukan adalah mengumpulkan uang ventura dengan sendirinya. Google sedang meletakkan pemeriksaan di dalam runtime sendiri.

Pipa verifikasi adalah penggunaan pertama yang diberi nama pelanggan. Alston Lin, pendiri dan kepala teknologi bank investasi AI-asli OffDeal, mengatakan bahwa hook pasca-eksekusi sekarang menjalankan pipa pemeriksaan gambar perusahaannya saat agen analis menulis daftar perusahaan, menerapkan aturan kualitas tingkat piksel pada puluhan logo yang diperlukan deck banker-siap. “Sebelum hook agen, kami tidak bisa melakukan ini di agen yang dikelola Gemini: sandbox adalah jarak jauh, sehingga kode validasi kami tidak memiliki tempat untuk dijalankan,” katanya.

Gemini 3.6 Flash mengambil alih sebagai default

Agen yang dikelola menjalankan Gemini 3.6 Flash tanpa perubahan kode, mengambilnya pada interaksi berikutnya. Pengembang dapat memasang model yang berbeda dengan melewatinya dalam konfigurasi agen, memilih Gemini 3.5 Flash untuk kontinuitas atau 3.5 Flash-Lite untuk biaya dan latensi yang lebih rendah. Untuk agen yang disimpan sebagai sumber daya persisten, model dipasang pada pembuatan dan tidak dapat dianulir per panggilan, yang Google katakan menjaga perilaku panggilan alat, debugging, dan batasan keamanan dapat diprediksi.

Google merilis 3.6 Flash pada 21 Juli 2026 bersama dengan 3.5 Flash-Lite dan 3.5 Flash Cyber yang dioptimalkan keamanan, peluncuran di mana bendera kapal 3.5 Pro yang tertunda dipindahkan kembali. Ini diberi harga $1,50 per juta token input dan $7,50 per juta token output, dibandingkan dengan $9,00 output untuk 3.5 Flash, dan perusahaan melaporkan bahwa ini mengonsumsi 17% lebih sedikit token output pada Indeks Analisis Buatan sambil mencetak 49% pada benchmark coding DeepSWE dibandingkan dengan 37% untuk pendahulunya. Profil token yang lebih murah adalah bagian yang penting di dalam loop agen, di mana satu tugas dapat berjalan selama ratusan langkah.

Batas pengeluaran dan jalankan terjadwal

Biaya adalah hal lain yang rilis ini alamatkan secara langsung. Langit-langit token yang dilewati dengan permintaan membatasi input, output, dan token pemikiran di seluruh interaksi; token yang di-cache dikecualikan, dan batasnya adalah upaya terbaik daripada pasti. Ketika agen mengenainya, jalannya kembali sebagai tidak lengkap dengan keadaan sandbox utuh, dan panggilan berikutnya melanjutkan pekerjaan dengan kuota segar. Perkiraan Google sendiri memperkirakan tugas pemrosesan data berat sebesar $0,70 hingga $3,25, dengan alur kerja kompleks yang mengumpulkan tiga hingga lima juta token dan sekitar $5 dalam satu interaksi. Komputasi sandbox tidak dikenakan biaya selama preview.

Dua tambahan mengubah agen menjadi infrastruktur yang berdiri sendiri daripada panggilan per permintaan:

  • Pemicu terjadwal mengikat agen, prompt, lingkungan, dan ekspresi cron menjadi sumber daya persisten yang diaktifkan sendiri, mematikan diri setelah lima kegagalan berturut-turut secara default. Setiap jalankan menggunakan kembali sandbox yang sama, sehingga file yang ditulis oleh satu eksekusi terlihat oleh yang berikutnya.
  • Antarmuka lingkungan daftar, inspeksi, dan menghapus sesi sandbox dari kode, yang memulihkan ID lingkungan setelah koneksi putus dan membersihkan sandbox ketika pipa selesai daripada menunggu kedaluwarsa tujuh hari.

Fitur-fitur ini dibangun di atas rilis 7 Juli 2026 yang memberikan agen yang dikelola eksekusi latar belakang, koneksi Model Context Protocol jarak jauh, panggilan fungsi kustom, dan penyegaran kredensial sesi tengah. Bersama-sama mereka meletakkan agen terjadwal, terbatas anggaran, dengan lapisan kebijakan yang dapat ditegakkan dalam jangkauan pengembang yang bekerja dari kunci API gratis.

Jonas Reeve adalah analis AI yang dihasilkan di Unite.AI, yang fokus pada kecerdasan buatan kognitif, kecerdasan buatan umum (AGI), dan landasan teori kecerdasan mesin. Karyanya mengeksplorasi bagaimana pembelajaran, penalaran, memori, dan abstraksi muncul dalam sistem biologis dan buatan, menghubungkan arsitektur AI modern dengan pertanyaan lama dalam ilmu kognitif dan filsafat pikiran.
Dengan pendekatan konseptual dan reflektif, Jonas memeriksa kerangka kerja seperti model penalaran, sistem agen, kognisi yang muncul, dan teori keselarasan, dengan tujuan untuk memperjelas apa yang dimaksud dengan kemajuan menuju AGI—dan apa yang tidak. Daripada mengejar garis waktu atau sensasi, ia menekankan prinsip-prinsip dasar, ketepatan konseptual, dan batasan model saat ini.
Artikel yang ditulis oleh Jonas Reeve dihasilkan oleh AI dan ditinjau oleh tim editorial Unite.AI untuk memastikan akurasi, kejelasan, dan diskusi yang bertanggung jawab tentang konsep AI lanjutan.