KI-Modelle und Plattformen
Google veröffentlicht drei Gemini-Flash-Modelle, während sein Flaggschiff zurückbleibt

Google veröffentlichte am 21. Juli 2026 drei neue Gemini-Modelle — Gemini 3.6 Flash, Gemini 3.5 Flash-Lite und ein sicherheitsorientiertes Modell namens Gemini 3.5 Flash Cyber —, während das Flaggschiff, das es ursprünglich für Juni angekündigt hatte, Gemini 3.5 Pro, weiterhin in begrenztem Testbetrieb mit Partnern bleibt. In derselben Aktualisierung gab das Unternehmen bekannt, dass es bereits mit dem sogenannten “ambitioniertesten Pre-Training-Lauf” für Gemini 4 begonnen hat.
Alle drei neuen Modelle befinden sich am günstigeren, schnelleren Ende von Googles Angebot: der “Flash”-Tier, der für Geschwindigkeit und hohe Volumina konzipiert ist, anstatt für maximale Tiefenschärfe. Diese Ausrichtung ist wichtig, da das Modell, das am oberen Ende des Marktes konkurrieren soll, 3.5 Pro, deutlich über den von Google auf der I/O-Konferenz im Mai 2026 gesetzten Zeitrahmen hinausgezögert wurde, wo es angekündigt wurde, dass die Pro-Version im folgenden Monat erscheinen würde. Google gibt nun nur bekannt, dass Pro bei Partnern getestet wird und ausgeliefert wird, wenn es bereit ist.
Was die neuen Modelle tun
Gemini 3.6 Flash ist der direkte Nachfolger des 3.5-Flash-Modells, das Google auf der I/O-Konferenz gestartet hat. Sein wichtigstes Verkaufsargument ist die Effizienz: Google gibt an, dass es etwa 17 % weniger Ausgabe-Tokens als 3.5 Flash im Artificial Analysis Index verwendet und weniger Schritte und Tool-Aufrufe benötigt, um mehrschrittige Aufgaben abzuschließen. Es kostet 1,50 $ pro Million Eingabe-Tokens und 7,50 $ pro Million Ausgabe-Tokens, was günstiger ist als der Vorgänger Flash, der 9 $ kostete. Sein Wissensstichtag wird um mehr als ein Jahr vorverlegt, von Januar 2025 auf März 2026.
Auf Googles eigenen Coding- und Agent-Benchmarks übertrifft 3.6 Flash seinen Vorgänger — 49 % gegenüber 37 % im DeepSWE-Coding-Test und 83 % gegenüber 78,4 % im OSWorld-Computer-Nutzungs-Benchmark, um nur einige zu nennen. Diese Zahlen sind vom Hersteller gemeldet und noch nicht von unabhängigen Prüfern bestätigt worden. Sie beschreiben, wie das neue Modell im Vergleich zum alten Modell abschneidet, nicht, wo es im Vergleich zu konkurrierenden Flaggschiffen liegt.
Gemini 3.5 Flash-Lite ist das günstigere Begleitmodell, das für hohe Durchsätze und geringe Latenzzeiten wie agierende Suche und Dokumentenverarbeitung konzipiert ist. Google bietet es für 0,30 $ pro Million Eingabe-Tokens und 2,50 $ pro Million Ausgabe-Tokens an und gibt an, dass es einen klaren Schritt nach vorne im Vergleich zum 3.1-Flash-Lite-Modell darstellt, das es ersetzt. Beide neuen Modelle sind heute im Gemini-App verfügbar, wobei Flash-Lite auch in der Suche verfügbar ist, und Entwickler können auf sie über Googles Antigravity-, AI-Studio- und Android-Studio-Tools zugreifen.
Ein Sicherheitsmodell, das kurz gehalten wird
Die dritte Veröffentlichung ist die ungewöhnlichere. Gemini 3.5 Flash Cyber ist fein abgestimmt, um Software-Schwachstellen zu finden, zu validieren und zu patchen, und es läuft innerhalb von CodeMender, Googles Code-Sicherheits-Agent. Anstatt es zu öffnen, beschränkt Google das Modell auf Regierungen und vertrauenswürdige Partner im Rahmen eines begrenzten Zugriffs-Testlaufs.
CodeMender ist der Grund, warum ein günstiges Modell hier Sinn ergibt. Der Agent scannt einen Code-Stapel nach Fehlern, ermittelt die Ursache jedes Fehlers und generiert dann einen Patch, bevor er nur hochwertige Korrekturen an einen Entwickler zur Genehmigung weiterleitet — ein Ansatz, den Google DeepMind bereits als erfolgreich beschrieben hat, mit 72 Korrekturen in Open-Source-Projekten innerhalb der ersten sechs Monate. Die Ausführung dieser Schleife mit einem Flash-Tier-Modell anstelle eines großen Flaggschiffs ermöglicht es Google, Schwachstellen-Erkennung im großen Maßstab und zu einem niedrigeren Preis pro Token als größere Modelle anzubieten.
Die Begrenzung ist der Hinweis darauf, dass dies eine Dual-Use-Technologie ist. Ein Modell, das gut darin ist, ausnutzbare Schwachstellen zu finden, ist ebenso nützlich für einen Angreifer, und Google hat die begrenzte Veröffentlichung um diese Spannung herum formuliert, indem es sagte, das Modell “wird den Verteidigern einen Vorsprung geben, um kritische Schwachstellen zu finden und zu beheben, bevor sie ausgenutzt werden können, während es gleichzeitig den weiteren Missbrauch verhindert”. Es ist dieselbe Berechnung, die in autonomen AI-Sicherheitsagenten auftaucht: Die Fähigkeit, die den Verteidigern hilft, ist die Fähigkeit, die sie beunruhigt.
Die Flaggschiff-Lücke
Keines von alledem schließt die Lücke, die Googles Sommer definiert hat. Die Flash-Veröffentlichungen sind inkrementell, und das Modell, das tatsächlich am oberen Ende des Marktes konkurrieren würde, fehlt noch immer, während Konkurrenten ausliefern. In etwa einer Woche wurden Grok 4.5, drei Varianten von OpenAIs GPT-5.6 und Moonshot AIs Kimi K3 veröffentlicht, und Anthropics Claude-Familie, angeführt von seinem Fable-5-Modell, steht an der Spitze der öffentlichen Leaderboards, die Googles Flash-Tier jetzt verfolgt. Der Druck ist nicht nur konkurrierend: Google muss sich auch gegen Regulierungsbehörden in Europa verteidigen, die Googles gezwungen haben, Android- und Suchdaten mit konkurrierenden AI-Assistenten zu teilen.
Googles Antwort ist es, auf Preis und Geschwindigkeit im Flash-Tier zu konkurrieren, anstatt auf Top-Leistung — dieselbe Strategie, die es im Mai durchgeführt hat, als 3.5 Flash den älteren 3.1 Pro in mehreren Coding-Tests übertraf, obwohl es die günstigere Option war. Es hält Google im Gespräch, ohne die Frage zu beantworten, die Entwickler eigentlich stellen.
Das ist der Hintergrund, vor dem die Gemini-4-Linie gelesen werden sollte. Den Start eines Pre-Training-Laufs anzukündigen, ist ein Statement der Absicht, nicht eine ausgelieferte Fähigkeit, und es sagt nichts über das, was das ergebnis sein wird, bis die Bewertungen existieren. Es ist hauptsächlich deshalb bemerkenswert, weil Google die nächste Generation ankündigt, während das Flaggschiff der aktuellen Generation immer noch im Testbetrieb steckt. Die Maßnahmen, die jetzt zählen, sind, ob 3.5 Pro endlich ausgeliefert wird und ob Gemini 4 mehr als ein Trainingslauf wird.












