Gemini 3.8 Flash : le modèle de Google qui talonne les grands
Google a lancé le 2 septembre 2026 Gemini 3.8 Flash, son troisième modèle Flash en six semaines. Le tarif ne bouge pas : 0,75 $ le million de tokens en entrée et 3,75 $ en sortie jusqu’au 31 décembre 2026, puis le double. Sur plusieurs tests d’agents en finance, en droit et en raisonnement, il dépasse Claude Opus 5 et GPT-5.6 Sol, pour un coût par tâche environ six fois inférieur à celui de Claude Fable 5.1 selon Artificial Analysis. Le modèle est déjà dans l’application Gemini pour les abonnés AI Pro et Ultra, dans Google Sheets et dans l’API.
Ce que Google a annoncé
Dans le billet officiel, signé par Tulsee Doshi et Raluca Ada Popa, Google présente 3.8 Flash comme son modèle de travail le plus intelligent, avec des gains nets par rapport à 3.7 Flash en génie logiciel, en tâches d’agents et en raisonnement à plusieurs étapes, au point d’approcher souvent des modèles bien plus chers. Gemini 3.6 Flash fin juillet, 3.7 Flash le 13 août, 3.8 Flash le 2 septembre : un Flash toutes les trois semaines, note Thurrott.
- Disponibilité : application Gemini pour les abonnés Google AI Pro et Ultra, AI Mode dans la recherche, Gemini dans Google Sheets ; pour les développeurs, Google AI Studio, Antigravity, Android Studio et l’API sous l’identifiant
gemini-3.8-flash; pour les entreprises, Gemini Enterprise. - Capacités : un million de tokens en entrée et 64 000 en sortie, d’après la page du modèle chez Google DeepMind.
- Comportement : sur les tâches complexes, Google parle de diligence : étapes de raisonnement supplémentaires et appels d’outils répétés jusqu’au résultat.
- Variante Cyber : Gemini 3.8 Flash Cyber, réservé aux gouvernements, aux opérateurs d’infrastructures critiques et aux mainteneurs de logiciels via le programme Fairwind. L’équipe sécurité de Chrome rapporte 2,6 fois plus de correctifs corrects que les meilleurs modèles commerciaux, pourtant bien plus gros.
Les chiffres : finance, droit, raisonnement
Les comparaisons publiées par Google portent sur des tests d’agents dans des métiers précis. Sur Vals Finance Agent v2, qui simule le travail d’un analyste financier, 3.8 Flash obtient 61,4 %, contre 59,0 % pour 3.7 Flash, 58,6 % pour Claude Opus 5 et 53,8 % pour GPT-5.6 Sol. Sur le test juridique de Harvey, il passe à 10,0 %, contre 8,8 % pour 3.7 Flash et 6,7 % pour Opus 5 : un score bas qui rappelle que le droit reste difficile pour toutes les IA. Sur HLE-Verified, un test de raisonnement multidisciplinaire, il atteint 54,9 %, à égalité pratique avec GPT-5.6 Sol (54,5 %) et Opus 5 (54,4 %).
The Register apporte une mesure indépendante, l’indice d’Artificial Analysis : 3.8 Flash y obtient 59, derrière Claude Fable 5.1 (66), Opus 5 (63) et GPT-5.6 Sol (61), mais pour 0,58 $ par tâche de l’indice contre 3,76 $ pour Fable 5.1. DataCamp tempère : les gains sont inégaux, et sur l’examen généraliste Humanity’s Last Exam le score ne bouge pas (45,4 % contre 45,7 %).
Même réserve qu’à chaque annonce : ces chiffres viennent de l’éditeur, sur des tests qu’il a choisis. Seul un essai sur vos propres documents tranche.
Le prix : un tarif d’appel avec une échéance
Le tarif de 0,75 $ en entrée et 3,75 $ en sortie est explicitement temporaire. Le billet de Google précise qu’il passe à 1,50 $ et 7,50 $ au 1er janvier 2027. Même doublé, il reste très en dessous de Claude Fable 5.1, à 10 $ et 50 $ comme nous l’écrivions hier, et de GPT-5.6 Sol, à 4 $ et 20 $ en promotion jusqu’au 21 novembre.
Gemini Enterprise : payer à l’usage plutôt qu’au siège
Une semaine avant le modèle, le 26 août, Google a ajouté à Gemini Enterprise une formule à la consommation, sans engagement ni abonnement de base. L’entreprise paie les tokens, la mémoire et le calcul au tarif standard. Selon eWeek, elle exige toutefois vingt sièges au minimum et n’est ouverte pour l’instant qu’à un groupe restreint de clients, quand l’abonnement classique démarre à 30 $ par utilisateur et par mois. Pour un dirigeant, l’utile est dans les garde-fous : un plafond mensuel qui suspend les agents quand le budget est atteint, des alertes à 50 %, 80 % et 100 %, et des remises de 10 % ou 20 % contre un engagement d’un ou trois ans.
Ce que ça change pour une PME
Si vous êtes abonné Google AI Pro ou Ultra, le modèle est déjà dans Sheets : c’est le bon endroit pour l’essayer sur un vrai fichier, un rapprochement de factures ou un tri de réponses clients. Si vous avez branché l’API dans un outil interne, le passage de 3.7 à 3.8 Flash demande surtout un test comparé sur vos trois tâches les plus fréquentes, et une ligne dans le budget pour janvier. La cadence de Google est aussi une leçon de conception, la même que celle des données Ramp : le modèle change tous les mois, vos processus doivent pouvoir en changer sans être reconstruits. Enfin, la variante Cyber ne vous concerne pas directement, mais elle confirme que la chasse aux failles s’automatise des deux côtés, comme le rappelaient cent grandes entreprises fin août.
Gemini 3.8 Flash est-il gratuit ?
Dans l’application Gemini, il est réservé aux abonnés Google AI Pro et Ultra. Via l’API, il est facturé à l’usage, 0,75 $ le million de tokens en entrée et 3,75 $ en sortie jusqu’au 31 décembre 2026, puis le double.
Faut-il quitter Claude ou ChatGPT pour Gemini 3.8 Flash ?
Non. Sur l’indice global d’Artificial Analysis, Fable 5.1, Opus 5 et GPT-5.6 Sol restent devant. L’intérêt de 3.8 Flash est le rapport entre son score et son prix sur les tâches répétitives : la bonne question n’est pas quel fournisseur choisir, mais quel modèle affecter à quelle tâche.
Un modèle plus fort et moins cher toutes les trois semaines, c’est une chance pour qui sait le mettre au travail. Les formations IA de Vincent Lévi partent de vos tâches réelles pour apprendre à comparer les modèles et à bâtir des automatisations qui survivent aux changements de prix. Si vous voulez savoir ce que Gemini 3.8 Flash vaut sur vos dossiers, écrivez à l’équipe : un test comparé tient en une matinée.




