AI-mallit ja alustat

Google Estää Kehittäjien Estää Gemini-Agenttien Työkalukutsut

mm
Lisää Unite.AI suosikkilähteisiisi Google-palvelussa

Google on lisännyt hallintakerroksen hallitsemiin agenteihin Gemini API: ssaan, jolloin kehittäjät voivat suorittaa oman koodin ennen ja jälkeen jokaisen työkalukutsun, jonka agentti tekee pilvisääntöpiirissään, ja peruuttaa kutsun kokonaan. Samassa päivityksessä Gemini 3.6 Flashista tulee oletusmalli agentin takana, rajoitetaan yhden suorituksen kuluttamien tokenien määrää ja avataan ominaisuus projekteille, joissa ei ole liitettynä laskutusta.

Hallitut agentit ovat Google:n isännöidyt versiot agentisilmukasta, joka on sama kuin avustimien taustalla, jotka nyt yhdistetään tekemään toimia sen sijaan, että ne vastaisivat kysymyksiin. Yksi API-kutsu varaa Linux-sääntöpiirin, ja malli suunnittelee, suorittaa koodia, asentaa paketteja, lukee ja kirjoittaa tiedostoja ja hakee verkkosivuja, kunnes tehtävä on valmis. Tämä arkkitehtuuri on se, mikä teki uuden ominaisuuden välttämättömäksi: sääntöpiiri oli paikka, jonne kehittäjät voivat lähettää työn, mutta he eivät voineet valvoa sitä sisäpuolelta.

Ympäristöön liittyvät koukut muuttavat tämän. hooks.json-tiedosto, joka on liitetty sääntöpiiriin, rekisteröi käsittelijöitä kahteen hetkeen silmukassa, ennen työkalun suorittamista ja sen jälkeen. Jokainen sääntö vastaa työkalun nimiä säännöllisellä lausekkeella, joten yksi merkintä voi kattaa koodin suorittamisen ja tiedostojen kirjoittamisen yhdessä tai kaikki kutsut. Kun ennen suorittamista tapahtuva käsittelijä palauttaa kiellon, suoritusaika ohittaa työkalukutsun ja välittää ilmoitetun syyn takaisin mallin kontekstiin, jossa agentti voi valita toisen reitin tai selittää eston käyttäjälle saman kierroksen aikana.

Mitä koukut tavoittavat

Koukut syttyvät työkaluilla, joita Google suorittaa säiliössä: koodin suorittaminen, tiedostojen lukeminen, kirjoittaminen, luettelo ja poistaminen. Kehittäjän asiakaspuolella suoritettavat mukautetut toiminnot ja etäiset Model Context Protocol -palvelimet suoritetaan säiliön ulkopuolella, joten koukut eivät niitä katkaise.

Virheet ratkeavat lupausten puolesta. Jos koukkukirjainti lopettaa virheen, aikakatkaisun, palvelinvirheen tai lähettää JSON: ia, jota suoritusaika ei tunnusta, työkalukutsu jatkuu. Google:n asiakirjat antavat syyn: rikkinäinen linter tai saavuttamaton telemetria-palvelin ei koskaan pitäisi pystyä jumittamaan tuotantosoftwarea.

Toisen käsittelijätyypin tapahtuma lähetetään suoraan ulkoiseen päätepisteeseen sääntöpiirin sisäverkosta, joka on tapa, jolla tapahtumaloki toimii. Nämä pyynnöt kulkevat Google:n egress-välityspalvelun kautta, joten kohde on oltava ympäristön sallimisluettelossa, ja todennusmerkit ovat verkkoasetuksissa eikä koukkutiedostossa, ja välittäjä lisää todelliset otsikot langassa. Google huomauttaa myös, että agentti, jolla on pääsy kuoriin tai kirjoitusoikeuksiin, voi muokata koukkutiedostoa kirjoitettavassa työtilassa, ja kehottaa kehittäjät, jotka tarvitsevat väärentämisenkestävyyttä, liittämään tämän konfiguraation lukituista varastosta.

Agenttien sallimien toimien valvonta on kerännyt venture-rahastoa. Google asettaa tarkastusominaisuuden omaan suoritusaikaansa.

Varmennusputket ovat ensimmäinen asiakas, jolle se antoi nimen. Alston Lin, AI-alkuperäisen investointipankin OffDeal perustaja ja teknologiajohtaja, sanoi, että post-suorituskoukku suorittaa nyt hänen yrityksensä kuvan tarkistusputken heti, kun sen analyytikkogentti kirjoittaa yritysten luettelon, ja pakottaa pikselitasoisen laadun säännöt kymmenille logoille, joita pankki valmis tarvitsee. “Ennen agenttikoukkuja emme voineet tehdä tätä Gemini:n hallituilla agenteilla: sääntöpiiri on etäinen, joten meidän validointikoodillamme ei ollut mihin suorittaa,” hän sanoi.

Gemini 3.6 Flashista tulee oletusarvo

Hallitut agentit suorittavat Gemini 3.6 Flashia ilman mitään koodin muutoksia, ottavat sen käyttöön seuraavassa vuorovaikutuksessa. Kehittäjät voivat kiinnittää toisen mallin määrittämällä sen agentin konfiguraatiossa, valitsemalla Gemini 3.5 Flashin jatkuvuuden vuoksi tai 3.5 Flash-Liten alhaisemman kustannuksen ja viiveen vuoksi. Agenttien, jotka on tallennettu kestäviksi resursseiksi, malli on kiinnitetty luomisessa eikä sitä voida ohittaa kutsu kerrallaan, mikä Google sanoo pitävän työkalukutsutoimintaa, virheenjäljitystä ja turvallisuusrajoja ennustettavina.

Google julkaisi 3.6 Flashin 21. heinäkuuta 2026 yhdessä 3.5 Flash-Liten ja turvallisuussuunnitellun 3.5 Flash Cyberin kanssa, julkaisussa, jossa viivästynyt 3.5 Pro -lippulaiva viivästyi jälleen. Sen hinta on 1,50 dollaria miljoonaa syötettävää tokenia kohden ja 7,50 dollaria miljoonaa tulostettavaa tokenia kohden, verrattuna 3.5 Flashin 9,00 dollarin tulostukseen, ja yhtiö ilmoittaa, että se kuluttaa 17 prosenttia vähemmän tulostustokeneja tekoälyanalyysin indeksillä ja saa 49 prosenttia DeepSWE-koodauskannettavuusmittauksessa verrattuna edeltäjäänsä, joka oli 37 prosenttia. Halvempi token-profiili on se, mikä on tärkeää agenttisilmukassa, jossa yksi tehtävä voi suorittaa satoja askelia.

Kustannusrajat ja ajoitettu suoritus

Kustannus on toinen asia, jota tämä julkaisu koskee suoraan. Tokenin katto, joka välitetään pyynnössä, rajoittaa syötettävät, tulostettavat ja ajattelutokenit koko vuorovaikutuksen ajan; välimuistitut tokenit ovat poissuljettuja, ja raja on parhaan pyrkimyksen mukaan eikä tarkka. Kun agentti osuu siihen, suoritus palautuu epätäydellisenä sääntöpiirin tilan säilyttäen, ja seuraava kutsu jatkaa työtä uudella myöntöluvan kanssa. Google:n arviot asettavat raskaan tietojen käsittelytehtävän 0,70 ja 3,25 dollarin välille, ja monimutkaiset työnkulut kerryttävät kolme ja viisi miljoonaa tokenia ja noin 5 dollaria yhdessä vuorovaikutuksessa. Sääntöpiirin laskutus ei ole voimassa esikatselun aikana.

Kaksi lisäystä muuttaa agentin pysyväksi infrastruktuuriksi eikä pyynnön perusteella kutsuksi:

  • Ajoitettu laukaisu sitoo agentin, kehotteen, ympäristön ja cron-lauseen pysyvään resurssiin, joka laukaisee itsenään, ja pysäyttää itsensä oletusarvoisesti viiden peräkkäisen epäonnistumisen jälkeen. Jokainen suoritus uudelleenkäyttää samaa sääntöpiiriä, joten tiedostot, jotka on kirjoitettu yhdellä suorituksella, ovat näkyvissä seuraavalle.
  • Ympäristöjen liittymä luetellaan, tarkastellaan ja poistetaan sääntöpiirisessioita koodista, joka palauttaa ympäristön tunnisteen yhteyskatkon jälkeen ja tyhjentää sääntöpiirit, kun putki päättyy sen sijaan, että odottaa niiden seitsemän päivän vanhenemista.

Ominaisuudet rakentuvat 7. heinäkuuta 2026 julkaisun päälle, joka antoi hallituille agenteille taustasuorituksen, etäisen Model Context Protocol -yhteyden, mukautetun toiminnon kutsun ja istunnon aikaisen todennusmerkin päivityksen. Nämä yhdessä antavat aikataulutetun, budjettirajoitetun agentin, jolla on pakollinen käytäntökerros, kehittäjän ulottuvilla, joka työskentelee ilmaisen API-avaimen kanssa.

Jonas Reeve on tekoälyanalyytikko Unite.AI:ssa, joka keskittyy kognitiiviseen tekoälyyn, tekoälyyn ja tekoälyjärjestelmien teoreettisiin perusteisiin. Hänen työnsä tutkii, miten oppiminen, päättely, muisti ja abstraktio ilmenevät sekä biologisissa että tekoälyjärjestelmissä, ja piirtää yhteyksiä modernien tekoälyarkkitehtuureiden ja kognitiivisen tieteen ja mielen filosofian pitkäaikaisiin kysymyksiin.
Konseptuaalisella ja refleksiivisellä lähestymistavalla Jonas tutkii kehyksiä, kuten päättelymalleja, agenteja, emergenttiä kognitiota ja suuntautumisteoriaa, pyrkien selventämään, mitä edistystä tekoälyssä tarkalleen ottaen tarkoittaa - ja mitä se ei tarkoita. Sen sijaan, että hän ajaisi aikatauluja tai hypeä, hän korostaa ensisijaisia periaatteita, konseptuaalista tarkkuutta ja nykyisten mallien rajoja.
Jonas Reeven kirjoittamat artikkelit ovat tekoälygeneroituja ja Unite.AI:n toimituksen tarkastamia, jotta varmistetaan ettei artikkeleissa käsitellä tekoälykonsepteja epätarkasti tai vastuuttomasti.