Gemini 3.8 Flash : Google sort son troisième modèle Flash en six semaines
Plus de raisonnement, plus de jetons consommés, et un tarif d'appel qui double au 1er janvier 2027 : Google accélère la cadence sur ses modèles Flash pour rester dans la course.
Photo : Taylor Vick / Unsplash
Le 2 septembre, Google a mis en ligne Gemini 3.8 Flash, sa troisième déclinaison de la gamme Flash en seulement six semaines. Le responsable produit IA de Google, Logan Kilpatrick, a lui-même insisté sur ce rythme inhabituel dans son message d'annonce : trois versions de Flash coup sur coup, alors que Google avait plutôt habitué son public à espacer ses grandes annonces de modèles.
Un sprint qui trahit une position de challenger
Ce tempo n'a rien de gratuit. Sur la consommation d'API en entreprise, Google reste troisième derrière Anthropic (40 %) et OpenAI (27 %), avec 21 % de part de marché selon le cabinet Menlo Ventures. Enchaîner les versions Flash — la 3.6, puis la 3.7, maintenant la 3.8 — est la stratégie de la firme pour rester dans la course auprès des développeurs, faute d'avoir sorti un nouveau modèle Pro depuis début 2026 : Gemini 3.5 Pro, promis puis repoussé, ne devrait pas arriver de sitôt selon Ars Technica.
Plus de raisonnement, plus de jetons consommés
Google présente la 3.8 Flash comme un modèle qui « travaille plus » : il enchaîne davantage d'étapes de raisonnement et multiplie les appels aux outils avant de répondre, ce qui l'aide par exemple à corriger un bug réparti sur plusieurs fichiers ou à mener une tâche nécessitant de se tester puis de se corriger. Revers de la médaille, assumé par Google lui-même : le modèle génère davantage de jetons, donc coûte potentiellement plus cher à l'usage malgré un tarif au jeton inchangé. Le cabinet Artificial Analysis, cité par The Verge, chiffre cette hausse à environ 30 % de jetons de sortie en plus par tâche.
Sur ses propres bancs d'essai, Google revendique la tête du classement DeepSWE v1.1, un test de développement logiciel au long cours, ainsi que 54,9 % sur HLE-Verified et des progrès sur des agents dédiés à la finance et au droit. Ars Technica note toutefois que le modèle reste nettement en retrait de Claude Opus sur OSWorld-2.0, le test d'usage autonome d'un ordinateur. Ces chiffres restent, comme pour toute annonce de ce type, des mesures maison, non vérifiées par un tiers indépendant.
Le même prix, mais jusqu'au 31 décembre seulement
Pour les développeurs, l'argument principal reste tarifaire : à performances en hausse, la facture au jeton ne bouge pas dans l'immédiat, à 0,75 dollar le million de jetons en entrée et 3,75 dollars en sortie. Mais ce tarif est explicitement qualifié d'« introductif » par Google : il double au 1er janvier 2027, pour atteindre 1,50 et 7,50 dollars. La promesse d'une IA plus capable au même prix a donc une date de péremption clairement affichée.
Une variante réservée aux « défenseurs de confiance »
Google publie en parallèle Gemini 3.8 Flash Cyber, une déclinaison tournée vers la détection et la correction de failles de sécurité, réservée aux gouvernements et à des partenaires triés sur le volet via le nouveau Fairwind Program, qui compterait 650 membres dont CrowdStrike et le Center for Internet Security.
un nouveau bond dans le codage et les tâches agentiques
La formule, employée par Logan Kilpatrick pour décrire la 3.8 Flash sur X, résume l'ambition affichée par Google. L'entreprise avance par ailleurs que l'équipe sécurité de Chrome aurait constaté une précision de correction multipliée par 2,6 avec ce nouveau modèle, et que son équipe Cloud aurait identifié une vulnérabilité critique en deux heures — des résultats internes, non audités, qui restent à confirmer à l'usage par les partenaires du programme.
Gemini 3.8 Flash standard est disponible dès aujourd'hui via l'API Gemini, AI Studio, la plateforme de développement Antigravity, et dans l'application Gemini pour les seuls abonnés payants Google AI Pro et Ultra — pas d'accès gratuit dans l'app grand public.
Source
Ars Technica : « Google releases Gemini 3.8 Flash, its third Flash model in six weeks »
Frandroid : « Gemini 3.8 Flash : Google sort son troisième modèle Flash en six semaines »
The Verge : « Google says its new Gemini 3.8 Flash model 'works harder' but might cost more »
À lire ensuite
OpenAI suspend les nouveaux abonnements ChatGPT Pro, débordée par la demande pour GPT-6 Astra
OpenAI a suspendu les nouvelles souscriptions à ChatGPT Pro, invoquant une demande sans précédent pour GPT-6 Astra. Les abonnés déjà inscrits ne sont pas concernés. La mesure fait écho, sans lui être formellement liée, à des propos de Sam Altman sur un ralentissement possible du rythme de l'IA.
Kelvyn3 min de lecture
DeepSeek V4.1 Flash mise sur des « N-grammes » pour alléger la mémoire de son modèle
DeepSeek dévoile V4.1 Flash, une mise à jour qui introduit des « N-grammes », un nouveau type de paramètres censé réduire fortement la consommation mémoire. Les chiffres d'efficience sont documentés, mais aucun benchmark de qualité ne vient encore les mettre en perspective.
Kelvyn2 min de lecture
Universal Music lance une plateforme IA de remix musical avec ElevenLabs
Universal Music Group annonce un accord pluriannuel avec ElevenLabs pour une plateforme IA de remix et mashup musicaux. La participation des artistes est optionnelle et aucune date de lancement public n'a été fixée.
Kelvyn3 min de lecture