Le 2 septembre 2026, Google a lancé Gemini 3.8 Flash et Gemini 3.8 Flash Cyber : son troisième modèle Flash en six semaines, trois semaines après la 3.7 Flash. Le message est assumé — Google accélère sur le segment « workhorse » : meilleures performances en code et en raisonnement, au même prix d’entrée que la 3.7. Avec un jumeau spécialisé cybersécurité, réservé aux défenseurs de confiance via le nouveau programme Fairwind.

Ce qui s’est passé

Deux variantes partageant la même intelligence de base, annoncées par Tulsee Doshi et Raluca Ada Popa (Google DeepMind) :

  • Gemini 3.8 Flash, le modèle généraliste, disponible dès maintenant à prix d’introduction identique à la 3.7 Flash : 0,75 $ / 1M tokens en entrée, 3,75 $ en sortie (tarif régulier 1,50 $ / 7,50 $ à partir de janvier 2027).
  • Gemini 3.8 Flash Cyber, spécialisé détection de vulnérabilités et correctifs automatiques, accessible aux « trusted defenders » via le Fairwind Program (gouvernements, opérateurs d’infrastructures critiques), qui compte déjà 650 membres dont CrowdStrike.

Côté benchmarks (vendor-reported, précautions d’usage), Google place la 3.8 Flash en tête du leaderboard DeepSWE v1.1, le benchmark de software engineering long-horizon, devant des modèles frontière plus chers — The Verge précise qu’elle devance notamment Claude Fable 5 d’Anthropic. S’y ajoutent des gains sur Vals Finance Agent V2 et le benchmark legal de Harvey, et 54,9 % sur HLE-Verified. Le modèle Cyber dépasse 70 % de réussite sur un benchmark interne couvrant 20 langages, et atteint 47,2 % pass@1 sur CWE-Bench, contre 47,8 % pour le leader — à coût bien moindre.

Le design choice assumé : « 3.8 works harder » — plus d’étapes de raisonnement, appels d’outils itératifs, au prix d’une consommation de tokens parfois supérieure, surtout à effort élevé.

Pourquoi c’est important

D’abord, la cadence. Trois Flash en six semaines, pendant qu’aucun modèle Pro « frontier » n’est sorti depuis début 2026 — Ars Technica estime que le Gemini 3.5 Pro est de plus en plus improbable. Google parie que le rapport qualité/prix du segment Flash suffit, d’autant que les labos ont récemment baissé leurs prix.

Ensuite, le piège du « works harder » : Artificial Analysis mesure un coût par tâche en hausse d’environ 40 % par rapport à la 3.7 Flash, malgré des prix par token inchangés (+30 % de tokens de sortie par tâche). La 3.7 Flash reste donc supportée pour les workloads efficiency-first.

Enfin, la cybersécurité devient un produit d’IA à part entière, avec une philosophie défensive assumée : corriger avant d’exploiter. Google cite son équipe Cloud Vulnerability Research, qui a trouvé une vulnérabilité critique en moins de 2 heures là où il fallait « des mois », et Chrome Security, qui produit 2,6 fois plus de patches corrects avec le modèle Cyber.

Implications pour les devs et le web

  1. Comparez le coût par tâche, pas le prix par token. Un modèle qui « travaille plus » peut alourdir la facture malgré un tarif identique. Mesurez sur vos propres workloads (tokens réels, retries, tours d’outils) avant d’adopter.
  2. Gardez un modèle « efficiency » sous le coude. La 3.7 Flash reste le bon choix pour les pipelines à budget contraint ; réservez la 3.8 aux tâches complexes.
  3. Le code long-horizon change de main. Des modèles à 0,75 $/M tokens en tête de DeepSWE : les agents de dev autonomes deviennent viables sur des tickets complexes, pas seulement du boilerplate.
  4. La cyber défensive s’automatise. Correctifs autonomes, programmes d’accès type Fairwind : si vous maintenez des libs ou des infra critiques, ces outils deviennent des arguments de sécurité à intégrer.

Côté accès : la 3.8 Flash est disponible via l’API (AI Studio, Antigravity, Android Studio), Gemini Enterprise, et pour les abonnés Google AI Pro/Ultra (app Gemini, AI Mode, Sheets).

Source