Μοντέλα και πλατφόρμες AI

Η Google Επιτρέπει στους Ανάπτυκτες να Αποκλείουν τις Κλήσεις Εργαλείων των Πρακτόρων Gemini

mm
Προσθέστε το Unite.AI στις προτιμώμενες πηγές σας στο Google

Η Google έχει προσθέσει ένα επίπεδο ελέγχου στους διαχειριζόμενους πράκτορες στο API Gemini, επιτρέποντας στους développers να εκτελούν τον δικό τους κώδικα πριν και μετά από κάθε κλήση εργαλείου που κάνει ένας πράκτορας μέσα στο cloud sandbox, και να ακυρώνουν την κλήση εξ ολοκλήρου. Η ίδια ενημέρωση καθιστά το Gemini 3.6 Flash το προεπιλεγμένο μοντέλο πίσω από τον πράκτορα, ορίζει το όριο των token που μπορεί να καταναλώσει μια seule εκτέλεση και ανοίγει τη λειτουργία σε projects χωρίς συναλλαγές.

Οι διαχειριζόμενες πράκτορες είναι η διαχειριζόμενη έκδοση του Google για το loop του πράκτορα, το ίδιο μοτίβο που βρίσκεται πίσω από τους βοηθούς που συνδέονται για να εκτελέσουν ενέργειες αντί να απαντήσουν σε ερωτήσεις. Μια κλήση API προμηθεύει ένα Linux sandbox, και το μοντέλο στη συνέχεια σχεδιάζει, εκτελεί κώδικα, εγκαθιστά πακέτα, διαβάζει και γράφει αρχεία, και ανακτά σελίδες web μέχρι να ολοκληρωθεί η εργασία. Αυτή η αρχιτεκτονική είναι αυτό που καθιστά τη νέα λειτουργία απαραίτητη: το sandbox ήταν ένα μέρος όπου οι développers μπορούσαν να στείλουν εργασία αλλά δεν μπορούσαν να την ελέγξουν από μέσα.

Οι environment hooks αλλάζουν αυτό. Ένα hooks.json αρχείο που είναι εγκατεστημένο στο sandbox καταγράφει χειριστές κατά δύο στιγμές στο loop, πριν από την εκτέλεση eines εργαλείου και μετά την ολοκλήρωσή του. Κάθε κανόνας αντιστοιχεί σε ονόματα εργαλείων με κανονική έκφραση, ώστε μια είσοδος να μπορεί να καλύψει την εκτέλεση κώδικα και την εγγραφή αρχείων μαζί ή να intercept κάθε κλήση. Όταν ένας χειριστής pre-execution επιστρέφει μια άρνηση, η runtime παραλείπει την κλήση του εργαλείου και περνά το αναφερθέν λόγο πίσω στο μοντέλο, όπου ο πράκτορας μπορεί να επιλέξει μια διαφορετική διαδρομή ή να εξηγήσει το μπλοκ στο χρήστη μέσα στην ίδια στροφή.

Τι φτάνουν οι hooks

Οι hooks ενεργοποιούνται στα εργαλεία που εκτελεί το Google μέσα στο container: εκτέλεση κώδικα, плюς οι εργασίες αρχείων που διαβάζουν, γράφουν, λίστα και διαγράφουν αρχεία. Οι custom functions που εκτελούνται από τον développer client-side και οι απομακρυσμένοι servers του Model Context Protocol τρέχουν έξω από το container, ώστε οι hooks δεν intercept αυτές.

Οι αποτυχίες λύνονται προς άδεια. Nếu ένας hook script εξέρχεται με σφάλμα, λήγει, επιστρέφει σφάλμα διακομιστή, ή εκπέμπει JSON που η runtime δεν αναγνωρίζει, η κλήση του εργαλείου συνεχίζει. Η τεκμηρίωση της Google δίνει το λόγο: ένας κατεστραμμένος linter ή ένας αθέατος διακομιστής τηλεμετρίας δεν πρέπει ποτέ να μπορεί να κλειδώσει μια εφαρμογή παραγωγής.

Ο δεύτερος τύπος χειριστή αποστέλλει το γεγονός κατευθείαν σε ένα εξωτερικό endpoint από μέσα στο δίκτυο sandbox, που είναι το πώς λειτουργεί η καταγραφή audit. Αυτές οι αιτήσεις ταξιδεύουν μέσω του egress proxy της Google, ώστε ο προορισμός πρέπει να βρίσκεται στην allowlist του περιβάλλοντος, και τα tokens αυθεντικοποίησης ζουν στη διαμόρφωση του δικτύου αντί για το αρχείο hook, με το proxy να εντάσσει πραγματικά headers στο wire. Η Google σημειώνει επίσης ότι ένας πράκτορας που κρατάει shell ή write access μπορεί να επεξεργαστεί ένα αρχείο hook σε ένα εγγράψιμο χώρο εργασίας, και κατευθύνει τους développers που χρειάζονται αντοχή σε αλλοίωση προς την τοποθέτηση αυτής της διαμόρφωσης από ένα αναγνώσιμο αποθετήριο.

Η επιβολή του τι επιτρέπεται σε έναν πράκτορα να κάνει είναι drawing venture money of its own. Η Google τοποθετεί το check μέσα στη δική της runtime.

Οι pipelines επαλήθευσης είναι η πρώτη χρήση που έδωσε ένα όνομα πελάτη. Ο Alston Lin, ιδρυτής και chief technology officer της AI-native investment bank OffDeal, είπε ότι ένας post-execution hook τώρα εκτελεί την image-checking pipeline της εταιρείας του την στιγμή που ο analyst agent γράφει μια λίστα εταιρειών, επιβάλλοντας κανόνες ποιότητας σε pixel-level για τις δεκάδες λογότυπα που χρειάζεται μια banker-ready deck. “Πριν από τους hooks του πράκτορα, δεν μπορούσαμε να κάνουμε αυτό με τους διαχειριζόμενους πράκτορες του Gemini: το sandbox είναι απομακρυσμένο, ώστε ο κώδικας επαλήθευσης μας δεν είχε που να τρέξει”, είπε.

Το Gemini 3.6 Flash παίρνει τη θέση του ως το προεπιλεγμένο

Ο διαχειριζόμενος πράκτορας εκτελεί το Gemini 3.6 Flash χωρίς καμία αλλαγή κώδικα, το οποίο λαμβάνει στην επόμενη αλληλεπίδραση. Οι développers μπορούν να καρφώσουν ένα διαφορετικό μοντέλο περνώντας το στη διαμόρφωση του πράκτορα, επιλέγοντας το Gemini 3.5 Flash για συνέχεια ή το 3.5 Flash-Lite για χαμηλότερο κόστος και καθυστέρηση. Για πράκτορες που αποθηκεύονται ως persistent resources, το μοντέλο είναι σταθερό στη δημιουργία και δεν μπορεί να αντικατασταθεί ανά κλήση, το οποίο η Google λέει ότι κρατάει τη συμπεριφορά της κλήσης εργαλείου, την αποσφαλμάτωση και τα όρια ασφαλείας προβλέψιμα.

Η Google κυκλοφόρησε το 3.6 Flash στις 21 Ιουλίου 2026 μαζί με το 3.5 Flash-Lite και ένα ασφαλειακό 3.5 Flash Cyber, την εκτόξευση στην οποία η καθυστερημένη 3.5 Pro flagship ήταν pushed back again. Το κόστος είναι $1.50 ανά εκατομμύριο input tokens και $7.50 ανά εκατομμύριο output tokens, έναντι $9.00 output για το 3.5 Flash, και η εταιρεία αναφέρει ότι καταναλώνει 17% λιγότερα output tokens στο Artificial Analysis Index ενώ σκοράρει 49% στο DeepSWE coding benchmark έναντι 37% για τον προκάτοχό του. Το φθηνότερο προφίλ token είναι το μέρος που μετράει μέσα σε ένα loop πράκτορα, όπου μια εργασία μπορεί να τρέξει για εκατοντάδες βήματα.

Όρια δαπανών και προγραμματισμένες εκτελέσεις

Το κόστος είναι το άλλο πράγμα που αυτή η κυκλοφορία αντιμετωπίζει απευθείας. Ένα όριο token που περνάμε με την αίτηση οριοθετεί τα input, output και σκέψη tokens σε όλη την αλληλεπίδραση; τα cached tokens εξαιρούνται, και το όριο είναι best-effort παρά ακριβές. Όταν ένας πράκτορας το χτυπήσει, η εκτέλεση επιστρέφει ως ατελής με την κατάσταση του sandbox ακέραιη, και μια επόμενη κλήση συνεχίζει την εργασία με μια νέα δόση. Οι εκτιμήσεις της Google τοποθετούν μια βαριά εργασία επεξεργασίας δεδομένων σε $0.70 έως $3.25, με σύνθετες εργασίες που συσσωρεύουν τρία έως πέντε εκατομμύρια tokens και περίπου $5 σε μια seule αλληλεπίδραση. Η υπολογιστική ισχύς του sandbox δεν χρεώνεται κατά τη διάρκεια της προεπισκόπησης.

Δύο προσθήκες μετατρέπουν τον πράκτορα σε σταθερή υποδομή αντί για μια κλήση ανά αίτηση:

  • Προγραμματισμένες εκτελέσεις δένουν έναν πράκτορα, μια πρόκληση, ένα περιβάλλον και μια cron expression σε μια persistent resource που πυροδοτεί από μόνη της, παύοντας τον εαυτό της μετά από πέντε συνεχείς αποτυχίες. Κάθε εκτέλεση επαναχρησιμοποιεί το ίδιο sandbox, ώστε τα αρχεία που γράφονται από μια εκτέλεση είναι ορατά στην επόμενη.
  • Μια διεπαφή περιβάλλοντος λίστα, επιθεωρεί και διαγράφει συνεδρίες sandbox από κώδικα, η οποία ανακτά ένα ID περιβάλλοντος μετά από μια dropped σύνδεση και καθαρίζει sandboxes όταν μια pipeline ολοκληρώνεται αντί να περιμένει την επτάημέρου λήξη τους.

Οι λειτουργίες αυτές χτίζονται σε μια κυκλοφορία της 7ης Ιουλίου 2026 που έδωσε στους διαχειριζόμενους πράκτορες εκτέλεση στο background, απομακρυσμένες συνδέσεις του Model Context Protocol, custom function calling και mid-session credential refresh. Μαζί τους τοποθετούν έναν προγραμματισμένο, προϋπολογισμένο πράκτορα με ένα επιβαλλόμενο επίπεδο πολιτικής εντός φθάνουσας ενός développer που εργάζεται από ένα δωρεάν API key.

Ο Jonas Reeve είναι ένας αναλυτής που δημιουργείται από AI στη Unite.AI, με επίκεντρο την γνωστική AI, την τεχνητή γενική νοημοσύνη (AGI) και τις θεωρητικές βάσεις της μηχανικής νοημοσύνης. Το έργο του εξετάζει πώς η μάθηση, ο συλλογισμός, η μνήμη και η αφαίρεση εμφανίζονται και σε βιολογικά και τεχνητά συστήματα, δημιουργώντας συνδέσεις μεταξύ σύγχρονων αρχιτεκτονικών AI και μακροχρόνιων ερωτημάτων στις γνωστικές επιστήμες και τη φιλοσοφία του νου. Με μια концепτουαλιστική και αναστοχαστική προσέγγιση, ο Jonas εξετάζει πλαισιά όπως τα μοντέλα συλλογισμού, τα συστήματα agentic, η αναδυόμενη γνωστική και η θεωρία ευθυγράμμισης, με στόχο να αποσαφηνίσει τι σημαίνει πραγματικά η πρόοδος προς την AGI - και τι όχι. Αντί να κυνηγά χρονοδιαγράμματα ή υπεροπτικές εκφράσεις, τονίζει τις αρχές, τη концепτουαλιστική αυστηρότητα και τα όρια των τρεχόντων μοντέλων. Τα άρθρα που γράφονται από τον Jonas Reeve δημιουργούνται από AI και αναθεωρούνται από την редакτική ομάδα της Unite.AI για να διασφαλιστεί η ακρίβεια, η σαφήνεια και η υπεύθυνη συζήτηση για προηγμένα концеп AI.