Gemini 3.7 Flash : -50 % en promo, prix doublé en janvier
Gemini 3.7 Flash : -50 % en promo, prix doublé en janvier
Gemini 3.7 Flash sort à -50 % le 13 août 2026, 3 semaines après 3.6. Tarif promo jusqu'au 31 décembre. Rouvrir le business case chatbot avant janvier.
Sommaire
- Ce que Google a annoncé le 13 août 2026, chiffres à la main
- Trois semaines entre 3.6 et 3.7 : ce que cette cadence dit à une DSI
- Le piège discret du 1er janvier 2027 : le tarif standard double
- Ce que ça change pour une entreprise française
- Cadre de décision : à quelle cadence rouvrir votre business case chatbot en 2026
- Conclusion
- Ce qu'il faut retenir
Parler de ce sujet avec Webotit
Google a sorti Gemini 3.7 Flash le 13 août 20261, trois semaines après 3.6 Flash4. Prix promo jusqu'au 31 décembre 2026 : 0,75 $ en entrée et 3,75 $ en sortie par million de tokens, moitié du 3.62. Le 1er janvier 2027, le tarif standard double à 1,50 $ et 7,50 $3. Toute DSI qui a signé un business case chatbot ou callbot en juillet doit rouvrir sa modélisation de coût complet (TCO) avant l'automne.
Ce que Google a annoncé le 13 août 2026, chiffres à la main
Google DeepMind a publié gemini-3.7-flash sur le Gemini API et Vertex AI le 13 août 2026, avec une cible produit explicite : génération de code, agents autonomes et traitement de documents en contexte entreprise.1
Trois éléments méritent d'être notés.
Le tarif promotionnel est fixé à 0,75 $ par million de tokens en entrée et 3,75 $ par million en sortie, jusqu'au 31 décembre 2026 inclus.2 C'est exactement la moitié du tarif de Gemini 3.6 Flash, sorti trois semaines plus tôt.
Le tarif standard entre en vigueur le 1er janvier 2027 à 1,50 $ en entrée et 7,50 $ en sortie.3 Autrement dit, le tarif que vous testerez cet automne doublera automatiquement le premier jour ouvré de 2027, sans intervention de votre part.
La cadence de sortie est inédite. Gemini 3.6 Flash est sorti le 22 juillet 2026. Gemini 3.7 Flash sort le 13 août 2026. Trois semaines et un jour entre deux modèles Flash, chacun présenté comme le modèle de travail polyvalent de sa génération.4
Trois semaines entre 3.6 et 3.7 : ce que cette cadence dit à une DSI
Un cycle produit LLM de trois semaines n'est pas anodin. Il change deux choses concrètes pour un acheteur français.
D'abord, il invalide l'idée d'un benchmark fournisseur annuel. Une DSI qui a démarré une évaluation Flash mi-juillet a comparé un modèle qui n'est plus en vitrine trois semaines plus tard. Les scores mesurés, les latences observées, les coûts projetés doivent être refaits sur 3.7 avant toute décision d'achat.
Ensuite, il rend caduque toute hypothèse de stabilité tarifaire à 12 mois. Un business case chatbot ou callbot signé en juillet 2026 sur la base des prix de Gemini 3.6 Flash sous-estime déjà la baisse. Un business case signé en août sur la base du prix promotionnel de 3.7 Flash sous-estime la remontée du 1er janvier 2027. Les deux cas produisent un chiffre au CODIR qui ne tiendra pas plus de six mois.
Pour un directeur relation client d'ETI qui pilote un projet chatbot capable d'automatiser le support client en phase pilote, le message est simple : le prix LLM n'est plus une variable qu'on fige au démarrage. C'est un flux qu'il faut instrumenter dans le pilotage mensuel du service.
Le piège discret du 1er janvier 2027 : le tarif standard double
Le doublement du prix au 1er janvier 2027 est le point que la plupart des lecteurs vont manquer.
Prenons un exemple paramétré pour illustrer, en gardant à l'esprit que le volume et la longueur des prompts dépendent entièrement de votre implémentation. Sur une hypothèse de 100 000 conversations mensuelles à 1 500 tokens en entrée et 400 tokens en sortie chacune (chiffres à remplacer par votre volume réel mesuré), le coût mensuel de la seule couche Gemini Flash passe d'environ 263 $ au tarif promotionnel à environ 525 $ au tarif standard, exactement le double.3 Sur un callbot 24/7 avec des prompts plus longs, l'écart mensuel se chiffre en centaines voire milliers d'euros selon la structure des conversations. Le principe est simple : le tarif Google double, votre coût LLM double à volume constant.
Ce n'est ni un scandale ni une clause abusive. C'est le fonctionnement normal d'un prix d'appel promotionnel. Le problème n'est pas Google. Le problème est le modèle mental : trop d'entreprises françaises signent aujourd'hui un business case chatbot en projetant un an de coût LLM avec le prix vu la semaine où le projet a été validé. Personne ne le corrige à mi-parcours.
La conséquence pratique : si vous préparez aujourd'hui un cadrage budgétaire pour 2027, vous devez modéliser deux scénarios. Un scénario T4 2026 au tarif promotionnel. Un scénario T1 2027 au tarif standard. Le CODIR doit voir les deux lignes, avec la date de bascule et le delta chiffré.
Ce que ça change pour une entreprise française
Le calibrage varie selon la taille et le secteur.
Pour une PME e-commerce française qui automatise le SAV avec un chatbot Flash sur un volume modeste, l'écart entre le tarif promotionnel et le tarif standard reste faible en absolu. Ce n'est pas ce qui va faire basculer le business case. En revanche, la cadence de sortie du modèle change la façon d'écrire le contrat avec l'intégrateur : une clause de revoyure trimestrielle sur le modèle utilisé devient plus utile qu'un tarif fixé pour douze mois.
Pour une ETI mutuelle, banque ou assurance qui pilote un déploiement callbot à volume élevé, l'enjeu double. D'un côté, l'écart cumulé sur 2027 peut peser lourd dans la ligne LLM du budget. De l'autre, la RSSI et la direction juridique doivent revalider la région d'exécution Vertex AI et la résidence des logs à chaque bascule de modèle, ce qui ne se fait pas en trois semaines. La bonne discipline : garder un modèle stable en production, tester 3.7 Flash en environnement de préproduction, ne basculer qu'après validation interne DPO, RSSI et direction juridique (AIPD mise à jour si le traitement le justifie), avec la clause budgétaire qui va bien.
Pour un grand compte français régulé (banque de détail, assureur santé, opérateur public), le tarif promotionnel n'est pas la variable pilote. La souveraineté, la résidence des données et la traçabilité d'inférence pèsent plus dans la décision. Mais l'annonce du 13 août sert d'aide-mémoire : un fournisseur qui divise ses tarifs par deux en trois semaines n'a pas encore stabilisé sa politique de prix. Toute nouvelle clause d'engagement pluriannuel doit intégrer une révision automatique à la baisse si le fournisseur baisse ses prix publics, et une couche métier orchestrée par des agents IA spécialisés côté français plutôt qu'un modèle unique posé sur toute la relation client.
Dans tous les cas, le sujet n'est pas de basculer immédiatement sur 3.7 Flash. C'est de rendre le pilotage tarifaire visible dans le comité mensuel du projet, avec un scénario T1 2027 déjà chiffré.
Cadre de décision : à quelle cadence rouvrir votre business case chatbot en 2026
Nous conseillons quatre déclencheurs concrets pour rouvrir un business case chatbot ou callbot, sans attendre l'audit budgétaire annuel.
Déclencheur 1 — Un fournisseur présélectionné baisse ses prix publics de plus de 30 %. C'est le cas de Gemini Flash cette semaine. Le business case doit être refait avec les nouveaux prix et un scénario "retour au tarif standard" si le nouveau prix est promotionnel.
Déclencheur 2 — Un fournisseur présélectionné sort un nouveau modèle de la même gamme. La sortie de 3.7 Flash trois semaines après 3.6 est le signal type. Les benchmarks internes doivent être refaits sur le nouveau modèle avant d'arbitrer.
Déclencheur 3 — Une date d'expiration promotionnelle approche à moins de 90 jours. Le 1er janvier 2027 tombe dans cette fenêtre à partir du 4 octobre 2026. Toute équipe qui utilise 3.7 Flash en promo doit avoir la variante "tarif standard" au budget dès octobre.
Déclencheur 4 — Un changement de résidence, de politique de données ou de région d'exécution. Sans lien direct avec cette annonce, mais souvent corrélé aux évolutions produit : quand un fournisseur ajoute une région EU ou modifie sa politique de non-conservation des données (ZDR), la RSSI doit revalider.
Ce cadre n'est pas théorique. Il transforme le pilotage LLM d'une décision annuelle en une routine mensuelle, ce qui correspond mieux à la cadence produit réelle de 2026.
Conclusion
Gemini 3.7 Flash n'est pas une révolution technique. C'est un signal de marché : les fournisseurs américains coupent leurs prix face à la pression chinoise (DeepSeek, Qwen, Kimi K3) et à la nécessité de rentabiliser des agents autonomes plus voraces en tokens. La bonne réponse d'une DSI française n'est pas "on migre". C'est "on instrumente le prix LLM dans le pilotage mensuel du projet, et on chiffre dès aujourd'hui le tarif de janvier 2027".
Vous préparez un business case chatbot ou callbot pour le T4 2026 et vous voulez modéliser l'impact d'une bascule Gemini Flash sur votre coût complet ? Cadrez votre estimation ROI en 20 minutes avec notre équipe.
Ce qu'il faut retenir
- 13 août 2026 : Google publie Gemini 3.7 Flash sur Gemini API et Vertex AI, ciblage génération de code, agents, traitement de documents.
- Tarif promotionnel jusqu'au 31 décembre 2026 : 0,75 $ en entrée, 3,75 $ en sortie par million de tokens, soit la moitié de 3.6 Flash.
- 1er janvier 2027 : le tarif standard s'applique automatiquement à 1,50 $ en entrée et 7,50 $ en sortie, doublant votre coût mensuel sans changement de socle technique.
- Cadence produit : 3 semaines et 1 jour entre 3.6 Flash (22 juillet) et 3.7 Flash (13 août). Tout benchmark fournisseur annuel devient obsolète.
- Conviction Webotit : ne pas basculer, mais instrumenter le prix LLM dans le pilotage mensuel, avec un scénario T1 2027 déjà chiffré au CODIR.
Questions frequentes
Quand Gemini 3.7 Flash a-t-il été lancé et à quel prix ?
Google a publié Gemini 3.7 Flash le 13 août 20261 sur le Gemini API, Google AI Studio et Gemini Enterprise. Le tarif promotionnel s'applique jusqu'au 31 décembre 2026 à 0,75 $ par million de tokens en entrée et 3,75 $ en sortie, soit la moitié du tarif de Gemini 3.6 Flash sorti le 22 juillet4. À partir du 1er janvier 2027, le tarif standard entre en vigueur à 1,50 $ et 7,50 $ respectivement3.
Pourquoi Google baisse-t-il le prix de son modèle Flash de 50 % ?
La baisse cible explicitement les charges agentiques et le code, où les volumes de tokens explosent et où le coût par requête devient un facteur d'adoption pour les DSI qui construisent des agents autonomes en 20262. Elle s'inscrit aussi dans un contexte de guerre de prix ouverte face à la pression tarifaire des modèles chinois (DeepSeek, Qwen, Kimi), qui offrent des performances proches à un coût inférieur.
Faut-il migrer un chatbot ou callbot existant sur Gemini 3.7 Flash ?
Pas avant d'avoir refait les benchmarks internes sur vos propres cas d'usage et chiffré l'écart réel sur votre volume. La bonne pratique en 2026 consiste à maintenir un modèle stable en production, tester le nouveau modèle en préproduction, valider la région d'exécution et la résidence des logs avec la RSSI, et ne basculer qu'après avoir modélisé les deux scénarios de tarif — promo T4 2026 et standard T1 2027.
Comment intégrer le doublement de prix du 1er janvier 2027 dans un business case ?
Il faut modéliser deux lignes budgétaires distinctes dans le business case CODIR. Une ligne T4 2026 au tarif promotionnel Gemini 3.7 Flash. Une ligne T1 2027 au tarif standard, avec la date de bascule visible et le delta chiffré sur votre volume mensuel réel. Cela évite l'effet « surprise de janvier » où le coût LLM double sur la première facture de l'année sans que personne l'ait vu venir.
Quelle cadence retenir pour rouvrir un business case LLM en 2026 ?
Nous recommandons quatre déclencheurs : baisse de prix supérieure à 30 % chez un fournisseur présélectionné ; sortie d'un nouveau modèle de la même gamme (3.6 vers 3.7) ; approche à moins de 90 jours d'une date d'expiration promotionnelle ; changement de région d'exécution ou de politique de données. Chacun impose une revoyure documentée du coût complet, plutôt qu'une simple validation annuelle qui ne colle plus à la cadence produit réelle de 2026.
Sources et references
Articles associés

Gemini 3.1 Flash-Lite GA : l'arbitrage coût-volume des ETI
Gemini 3.1 Flash-Lite passe en GA le 7 mai 2026 : 0,25 $ / 1,50 $ par million de tokens, contexte 1M, 2,5x plus rapide. Quoi en faire pour un chatbot ETI.
Lire
Gemini 3.5 Flash : le piège du Flash premium
Benchmarks, prix réel, premiers retours : analysez Gemini 3.5 Flash avant de remplacer Claude, GPT ou Gemini 3.1 Pro.
Lire
GPT-5.4 vs Gemini 3.1 : la guerre des prix LLM profite aux ETI
Analysez la chute de 80% des prix API des LLM en 2026 et son impact concret sur les projets chatbot et agents IA des entreprises françaises.
Lire