AI-modellen en platforms

Google lanceert Gemini 3.8 Flash met cybersecurity‑variant

mm
Voeg Unite.AI toe aan je voorkeursbronnen op Google

Google heeft op 2 september 2026 Gemini 3.8 Flash geïntroduceerd, het nieuwste model in de Flash‑reeks, tegen een introductieprijs van $0,75 per miljoen invoertokens en $3,75 per miljoen uitvoertokens tot en met 31 december 2026, samen met een beperkte cybersecurity‑variant genaamd Gemini 3.8 Flash Cyber. De aankondiging van het bedrijf omschreef de uitgave als de derde Flash‑update in zes weken, drie weken na Gemini 3.7 Flash.

Google beschreef Gemini 3.8 Flash als zijn meest intelligente werkpaard‑model, met aanzienlijke verbeteringen ten opzichte van 3.7 Flash op het gebied van software‑engineering, agent‑taken en meerstapsredeneren in gespecialiseerde domeinen. Het model is algemeen beschikbaar en klaar voor productiegebruik onder model‑ID gemini-3.8-flash.

Prijs en Beschikbaarheid

Het introductietarief komt overeen met de prijs van 3.7 Flash en geldt voor Google AI Studio en het Gemini Enterprise Agent Platform. Vanaf 1 januari 2027 treedt de standaardprijs van $1,50 per miljoen invoertokens en $7,50 per miljoen uitvoertokens in werking, volgens de ontwikkelaarsdocumentatie.

Gemini 3.8 Flash ondersteunt een contextvenster van één miljoen tokens, een maximum van 64.000 uitvoertokens en instelbare denkniveaus laag, gemiddeld en hoog, waarbij gemiddeld de standaard is. Google zei dat het model kleinere redeneerstappen neemt, tools iteratief aanroept en zijn werk verifieert bij moeilijke meerstapsdoelen, en bij complexe taken per ontwerp meer tokens kan gebruiken, vooral bij hogere inspanningsniveaus. Voor workloads die efficiëntie vooropstellen, kunnen ontwikkelaars de redeneerinspanning verlagen of doorgaan met het gebruik van Gemini 3.7 Flash, dat volledig ondersteund blijft.

Ontwikkelaars kunnen het model benaderen via de Gemini‑API in Google AI Studio, Android Studio en Google Antigravity, de agent‑first ontwikkelomgeving van Google. De door Antigravity beheerde agent draait nu standaard op Gemini 3.8 Flash. Bedrijven kunnen er toegang toe krijgen via Gemini Enterprise, en consumenten met een Google AI Pro‑ of Ultra‑abonnement kunnen het gebruiken in de Gemini‑app, AI‑modus in Google Search en Gemini in Google Sheets.

Gerapporteerde Prestaties

Google meldde dat Gemini 3.8 Flash vaak de prestaties van duurdere frontier‑modellen benadert. Op DeepSWE v1.1, een langetermijnsoftware‑engineeringbenchmark, zei het bedrijf dat het model de meeste grotere frontier‑modellen overtreft in het autonoom oplossen van complexe engineeringproblemen van begin tot eind. Google meldde ook dat het beter presteert dan 3.7 Flash en andere frontier‑modellen op Vals Finance Agent V2 en Harvey’s Legal Agent Benchmark, en een score van 54,9 % behaalt op HLE‑Verified, een benchmark die meerstapsredeneren over STEM, geesteswetenschappen en beroepsgebieden omvat.

Google schrijft de verbeteringen toe aan training in veeleisende domeinen, waaronder cybersecurity, en aan langdurige agent‑loops die de onderliggende modellen recursief evalueren en verfijnen. Beide nieuwe varianten delen dezelfde fundamentele intelligentie.

Gemini 3.8 Flash Cyber en het Fairwind‑programma

De tweede variant, Gemini 3.8 Flash Cyber, richt zich op kwetsbaarheidsdetectie en geautomatiseerde patching. Toegang is beperkt tot vertrouwde verdedigers via Google’s nieuwe Fairwind‑programma, dat prioritaire toegang biedt aan overheidsinstanties, exploitatie‑operators van kritieke infrastructuur en software‑onderhouders die zich aanmelden.

Op CyberGym, een industriële benchmark voor autonome kwetsbaarheidsdetectie, zei Google dat het model frontier‑niveau bereikt en zowel 3.5 Flash Cyber als aanzienlijk grotere frontier‑modellen overtreft. Op een interne benchmark die 20 programmeertalen beslaat, rapporteerde Google een succesratio van meer dan 70 %. Op CWE‑Bench, een externe patch‑benchmark uitgevoerd door Collinear, noteerde het model een pass@1 van 47,2 % tegenover 47,8 % van een toonaangevend frontier‑model, wat Google karakteriseerde als Pareto‑frontier‑prestaties tegen aanzienlijk lagere kosten.

Google zei dat het Chrome Security‑team ontdekte dat het model 2,6 maal meer correcte patches voor Chrome‑kwetsbaarheden opleverde dan de beste grotere commerciële modellen. Wiz meldde een 7,5 tot 9,7 % hogere recall op haar interne penetratietest‑benchmark, tegen 2,3 tot 5,2 maal lagere kosten dan andere toonaangevende frontier‑modellen, aldus Google. Het Cloud Vulnerability Research‑team van Google gebruikte het model om binnen twee uur een kritieke fundamentele kwetsbaarheid te vinden, een proces dat het bedrijf normaal gesproken maanden kost.

Veiligheidsmaatregelen

Google zei dat Gemini 3.8 Flash wordt geleverd met beveiligingen tegen misbruik in chemische, biologische, radiologische en nucleaire domeinen en cyberaanvallen onder zijn Frontier Safety Framework. De Cyber‑variant bevat een meer permissieve reeks cybersecurity‑mitigaties, wat volgens het bedrijf de reden is dat deze beperkt blijft tot vertrouwde verdedigers. Google meldde bovendien een aanzienlijke verbetering in de robuustheid tegen prompt‑injectie voor de Gemini 3.8‑modellen, gemeten door Gray Swan.

Jonas Reeve is een AI-gegenereerde analist bij Unite.AI, met een focus op cognitieve AI, kunstmatige algemene intelligentie (AGI) en de theoretische grondslagen van machine-intelligentie. Zijn werk onderzoekt hoe leren, redeneren, geheugen en abstractie ontstaan in zowel biologische als kunstmatige systemen, en trekt verbindingen tussen moderne AI-architecturen en langdurige vragen in cognitieve wetenschap en filosofie van de geest.
Met een conceptuele en reflectieve benadering, onderzoekt Jonas kaders zoals redeneermodellen, agente systemen, emergente cognitie en align-theorie, met als doel om duidelijk te maken wat vooruitgang naar AGI eigenlijk betekent - en wat niet. In plaats van tijdlijnen of hype na te jagen, benadrukt hij eerst principes, conceptuele rigor en de beperkingen van huidige modellen.
Artikelen geschreven door Jonas Reeve zijn AI-gegenereerd en worden beoordeeld door het redactionele team van Unite.AI om ervoor te zorgen dat ze accurate, duidelijke en verantwoorde discussies over geavanceerde AI-concepten bevatten.