Gemini 3.7 Flash à moitié prix : ce que ça change pour vous

Google lance Gemini 3.7 Flash à moitié prix : la guerre des prix de l’IA s’accélère

Le 13 août 2026, Google DeepMind a lancé Gemini 3.7 Flash, un modèle taillé pour le code et les agents, à un prix d’appel de 0,75 $ par million de tokens en entrée et 3,75 $ en sortie — la moitié du tarif de Gemini 3.6 Flash, sorti trois semaines plus tôt. L’offre vaut jusqu’au 31 décembre 2026, avant un retour à 1,50 $ et 7,50 $. Cette annonce s’inscrit dans une bataille tarifaire ouverte entre Google, OpenAI, Anthropic et DeepSeek : pour une PME, le coût d’intégrer l’IA dans ses processus n’a jamais été aussi bas — et le vrai sujet devient de savoir quoi en faire.

Ce que Google a annoncé exactement

Dans son billet officiel, Google présente 3.7 Flash comme « son modèle de travail le plus intelligent à ce jour pour le code et les agents ». Les gains mesurés par rapport à 3.6 Flash sont nets :

  • FrontierCode 1.1 Main (génération de code de production) : 43,6 % contre 34,4 % ;
  • DeepSWE v1.1 (résolution de tickets logiciels réels) : 65,3 % contre 49,0 % ;
  • AutomationBench (automatisation de tâches d’entreprise) : 30,4 % contre 17,0 % ;
  • WebDev Arena (développement web) : score Elo de 1588 contre 1538 ;
  • GDP.pdf (tâches de connaissance : finance, droit, biosciences) : 34,0 % contre 22,0 %.

Le modèle est disponible dès maintenant dans Google AI Studio et l’API Gemini, dans Android Studio, dans l’environnement agentique Antigravity et sur la Gemini Enterprise Agent Platform. Les abonnés Google AI Pro et Ultra en profitent aussi via Gemini Spark dans plus de 160 pays. VentureBeat souligne le rythme : deux versions de Flash en trois semaines, alors que la gamme Pro, plus lourde, évolue plus lentement.

Infographie : Gemini 3.7 Flash à 0,75 $ le million de tokens en entrée et 3,75 $ en sortie jusqu’au 31 décembre 2026, avec les progrès sur FrontierCode (43,6 %), DeepSWE (65,3 %) et AutomationBench (30,4 %)
Un tarif divisé par deux jusqu’à fin 2026, et des scores en hausse de 10 à 16 points selon les tests.

Une guerre des prix qui touche tous les acteurs

Le geste de Google n’est pas isolé. Le 24 juillet, Anthropic lançait Claude Opus 5 à 5 $ le million de tokens en entrée et 25 $ en sortie, soit la moitié de son modèle haut de gamme Fable 5 (10 $ et 50 $). Le 14 août, OpenAI a dévoilé Ultrafast, un mode d’API qui fait tourner GPT-5.6 Sol jusqu’à 14 fois plus vite (750 tokens par seconde) grâce aux puces Cerebras — en avant-première limitée, sans prix publié pour l’instant.

Seule exception notable : DeepSeek prend le chemin inverse. Fortune rapporte qu’à partir du 16 août, le laboratoire chinois multiplie ses tarifs par plus de quatre en heures de pointe : V4-Flash passe de 0,28 $ à 1,32 $ le million de tokens (0,66 $ hors pointe) et V4-Pro de 0,87 $ à 3,96 $ (1,98 $ hors pointe). Résultat paradoxal : le nouveau Flash de Google se retrouve moins cher en entrée que le modèle Pro de DeepSeek en heures de pointe. Comme le résume InfoWorld, le prix de « l’intelligence machine utile » ne cesse de se comprimer, et les critères d’achat des entreprises se déplacent vers l’efficacité par token plutôt que vers les seuls benchmarks.

Frise chronologique de la guerre des prix de l’IA : Claude Opus 5 à moitié prix le 24 juillet, Gemini 3.7 Flash à moitié prix le 13 août, OpenAI Ultrafast le 14 août, hausse des tarifs DeepSeek le 16 août 2026
En trois semaines, trois baisses ou accélérations chez les acteurs occidentaux — et une hausse chez DeepSeek.

Ce que ça change concrètement pour vous

Le coût n’est plus un frein pour automatiser

À 0,75 $ le million de tokens en entrée, traiter l’équivalent de plusieurs centaines de pages de documents coûte quelques centimes. Trier des e-mails, extraire des données de factures, résumer des comptes rendus, générer une première version de code : ces usages devenaient rentables l’an dernier, ils le sont franchement aujourd’hui. La question pour une PME n’est plus « combien ça coûte » mais « quel processus vaut la peine d’être confié à un agent ».

Les modèles « légers » suffisent pour la plupart des tâches

Les scores de 3.7 Flash sur DeepSWE ou AutomationBench montrent qu’un modèle rapide et bon marché exécute désormais des tâches qui exigeaient un modèle premium il y a six mois. Réserver les gros modèles aux cas complexes et faire tourner le quotidien sur un Flash : c’est la logique que les équipes techniques adoptent, et qu’il faut comprendre même sans écrire une ligne de code.

Méfiez-vous des prix d’appel

Le tarif de Google est explicitement temporaire : il double au 1er janvier 2027. Et l’exemple de DeepSeek rappelle qu’un fournisseur peut multiplier ses prix du jour au lendemain. Toute automatisation sérieuse doit donc pouvoir changer de modèle sans tout reconstruire — c’est un critère de conception, pas un détail.

Gemini 3.7 Flash remplace-t-il les modèles Pro ou Fable ?

Non. Google le positionne comme un « modèle de travail » pour le code, les agents et les tâches répétitives. Pour le raisonnement long, l’analyse à fort enjeu ou la recherche, les modèles haut de gamme (Gemini Pro, Claude Fable 5, GPT-5.6 Sol) gardent l’avantage — à un prix cinq à quinze fois supérieur.

Combien coûte réellement l’IA pour une PME aujourd’hui ?

Pour un usage courant via API, la facture se compte en dizaines de francs par mois plutôt qu’en centaines : à 0,75 $ le million de tokens en entrée, un million de tokens représente environ 750 000 mots traités. Le vrai coût se situe dans le temps de conception des processus et la formation des équipes, pas dans les tokens.

Des modèles plus performants et moins chers chaque mois, c’est une chance — à condition de savoir choisir le bon outil pour chaque tâche et de bâtir des processus qui résistent aux changements de prix. C’est précisément ce que Vincent Lévi et son équipe transmettent dans leurs formations IA, de la prise en main individuelle (IA Académie) à l’automatisation des équipes (Business IA). Pour identifier les processus de votre entreprise qui méritent d’être automatisés en priorité, écrivez directement à l’équipe : réponse sous 48 heures.

Examine more articles