Modèles et plateformes d’IA
Google lance trois modèles Flash Gemini tandis que son modèle phare reste bloqué

Google a lancé trois nouveaux modèles Gemini le 21 juillet 2026 — Gemini 3.6 Flash, Gemini 3.5 Flash-Lite et un modèle de sécurité appelé Gemini 3.5 Flash Cyber — tandis que le modèle phare qu’il avait promis pour juin, Gemini 3.5 Pro, reste en test limité avec des partenaires. Dans la même mise à jour, l’entreprise a déclaré qu’elle a déjà commencé ce qu’elle appelle “notre pré-formation la plus ambitieuse à ce jour” pour Gemini 4.
Tous les trois nouveaux modèles se situent à l’extrémité la moins chère et la plus rapide de la gamme de Google : le niveau “Flash” conçu pour la vitesse et le volume élevé plutôt que pour une profondeur de raisonnement maximale. Ce cadrage est important car le modèle destiné à concurrencer les meilleurs du marché, 3.5 Pro, a bien dépassé la date cible que Google avait fixée sur scène lors de sa conférence I/O en mai 2026, où il avait déclaré que la version Pro arriverait le mois suivant. Google déclare maintenant seulement que Pro est en test avec des partenaires et sera livré lorsqu’il sera prêt.
Ce que font les nouveaux modèles
Gemini 3.6 Flash est le successeur direct du modèle 3.5 Flash que Google a lancé à l’I/O. Son principal argument de vente est l’efficacité : Google déclare qu’il utilise environ 17 % de jetons de sortie en moins que 3.5 Flash sur l’indice d’analyse artificielle et prend moins d’étapes de raisonnement et d’appels d’outils pour terminer les tâches multétapes. Il est facturé 1,50 $ par million de jetons d’entrée et 7,50 $ par million de jetons de sortie, moins cher en sortie que les 9 $ facturés par le Flash précédent. Sa date de fin de connaissance avance de plus d’un an, de janvier 2025 à mars 2026.
Sur les benchmarks de codage et d’agent de Google, 3.6 Flash surpasse son prédécesseur — 49 % contre 37 % sur le test de codage DeepSWE, et 83 % contre 78,4 % sur le benchmark d’utilisation informatique OSWorld, entre autres. Ce sont des chiffres rapportés par le fournisseur, et non des mesures indépendantes, et aucun évaluateur externe ne les a encore reproduits. Ils décrivent comment le nouveau modèle se compare à l’ancien, et non où il se situe par rapport aux modèles phare des rivaux.
Gemini 3.5 Flash-Lite est le compagnon moins cher, destiné à des travaux à haut débit et faible latence tels que la recherche agente et le traitement de documents. Google le facture 0,30 $ par million de jetons d’entrée et 2,50 $ par million de jetons de sortie et déclare qu’il s’agit d’une nette amélioration par rapport au modèle 3.1 Flash-Lite qu’il remplace. Les deux nouveaux modèles sont disponibles aujourd’hui dans l’application Gemini, avec Flash-Lite qui sera également disponible dans la recherche, et les développeurs peuvent y accéder via les outils Antigravity, AI Studio et Android Studio de Google.
Un modèle de sécurité tenu en laisse courte
La troisième version est la plus inhabituelle. Gemini 3.5 Flash Cyber est affiné pour trouver, valider et corriger les vulnérabilités de logiciels, et il s’exécute à l’intérieur de CodeMender, l’agent de sécurité de code de Google DeepMind. Au lieu de l’ouvrir, Google restreint le modèle aux gouvernements et aux partenaires de confiance dans le cadre d’un programme de test à accès limité.
CodeMender est la raison pour laquelle un modèle bon marché a du sens ici. L’agent scanne une base de code pour les failles, détermine la cause profonde de chacune, puis génère et vérifie automatiquement une correction avant de router uniquement des corrections de haute qualité à un développeur pour approbation — une approche que Google DeepMind a déclaré avoir déjà produit 72 corrections en amont pour des projets open source au cours de ses six premiers mois. Exécuter cette boucle avec un modèle de niveau Flash plutôt qu’un modèle phare plus important est ce qui permet à Google de proposer la détection de vulnérabilités à grande échelle et à un prix inférieur par jeton que les modèles plus importants.
La restriction est le signe que c’est une technologie à double usage. Un modèle capable de trouver des bogues exploitables est également utile à un attaquant, et Google a présenté la version restreinte autour de cette tension, déclarant que le modèle “donnera aux défenseurs de première ligne une longueur d’avance pour trouver et corriger les vulnérabilités critiques avant qu’elles ne puissent être exploitées, tout en atténuant une utilisation plus large”. C’est le même calcul qui apparaît dans les agents de sécurité autonomes : la capacité qui aide les défenseurs est la capacité qui les inquiète.
L’écart du modèle phare
Rien de tout cela ne comble l’écart qui a défini l’été de Google. Les versions Flash sont incrémentielles, et le modèle qui concourrait réellement au sommet du marché est toujours absent tandis que les rivaux livrent. En environ une semaine, Grok 4.5, trois variantes de GPT-5.6 d’OpenAI et Moonshot AI’s Kimi K3 ont tous été lancés, et la famille Claude d’Anthropic, menée par son modèle Fable 5, se situe au sommet des classements publics que le niveau Flash de Google suit maintenant. La pression n’est pas seulement concurrentielle : Google se défend également contre les régulateurs en Europe, qui l’ont obligé à partager les données Android et de recherche avec des assistants d’IA rivaux.
La réponse de Google, pour l’instant, est de concurrencer sur le prix et la vitesse au niveau Flash plutôt que sur les capacités de premier plan — la même stratégie qu’il a adoptée en mai, lorsque 3.5 Flash a battu l’ancien 3.1 Pro sur plusieurs tests de codage malgré être l’option moins chère. Cela permet à Google de rester dans la conversation sans répondre à la question que les développeurs se posent réellement.
C’est le contexte dans lequel la ligne Gemini 4 doit être lue. Commencer une pré-formation est une déclaration d’intention, et non une capacité livrée, et cela ne dit rien sur ce que le modèle résultant fera jusqu’à ce que les évaluations existent. C’est notable principalement pour ce qu’il signale : Google parle de la prochaine génération tandis que le modèle phare actuel reste bloqué en test. Les mesures qui comptent maintenant sont de savoir si 3.5 Pro sera finalement livré, et si Gemini 4 se révèle être plus qu’un simple entraînement.












