HomeBlog › Gemini 3.7 Flash price doubling Jan 2027

Le prix d'introduction de Gemini 3.7 Flash double en 100 jours. Voici ce que cela vous coûte réellement

22 septembre 2026 · AI & LLM · 5 min de lecture

Google shipped Gemini 3.7 Flash on September 2 at $0.75 per million input tokens and $3.75 per million output — cheap enough that plenty of teams wired it straight into production without reading the fine print under the price table. That fine print says the rate holds "through December 31, 2026." Starting January 1, 2027 — 100 days from today — the exact same model, same weights, same output, bills $1.50/$7.50. A clean doubling, on both input and output, with no model swap and no separate announcement beyond a line in Google's own pricing docs. I checked that rate card directly, matched it against our own tracked pricing on apicostcalc.com/gemini.html, and ran two real workloads through both sides of the deadline to see what the doubling actually adds to a bill.

La carte tarifaire, avant et après

ModèleMaintenant, jusqu'au 31 décembre 2026À partir du 1er janvier 2027Changement
Gemini 3.7 Flash — entrée$0.75$1.502.00x
Flash Gemini 3.7 — sortie$3.75$7.502.00x
Gemini 3.1 Flash-Lite$0.25 / $1.50$0.25 / $1.50aucun changement noté
Gémeaux 2.5 Flash (génération précédente)$0.30 / $2.50$0.30 / $2.50aucun changement noté

Seul Gemini 3.7 Flash porte cette expiration spécifique — les propres documents de Google le signalent comme un taux de lancement, pas les autres modèles 3.x. C'est le même mécanisme qu'un taux de lancement promotionnel sur un plan SaaS : obtenir l'adoption à la porte pas cher, puis passer au nombre que le modèle allait toujours coûter une fois la période d'essai gratuite terminée. Rien sur le modèle ne change le 1er janvier — même fenêtre de contexte, même classe de latence, mêmes scores de référence. Seule la facture le fait.

Charge de travail 1 : un travail par lots de modération ou de classification

Un pipeline de modération de contenu marquant 200 millions de jetons d'entrée et générant 20 MILLIONS de jetons de sortie par mois — une forme typique pour un travail qui lit beaucoup de texte et réécrit des étiquettes courtes.

Entrée (200M)Sortie (20M)Total mensuel
Maintenant (jusqu'au 31 décembre)$150.00$75.00$225.00
À partir du 1er janvier 2027$300.00$150.00$450.00

225 $ de plus par mois pour un travail facile à sous-estimer, précisément parce que 225 $ ne semble pas beaucoup. C'est toujours un doublement exact — le même multiplicateur s'applique que la facture de base soit de 225 $ ou de 225 000 $ .

Charge de travail 2 : une application RAG au volume de demande réel

Une application augmentée de récupération servant 500 000 demandes par mois, chacune tirant environ 3 000 jetons de contexte récupéré plus la requête de l'utilisateur, et écrivant une réponse de 300 jetons. Cela représente 1 500 millions de jetons d'entrée et 150 MILLIONS de jetons de sortie par mois — une charge de travail suffisamment importante pour que cette échéance apparaisse comme une véritable ligne budgétaire, et non comme une erreur d'arrondi.

Entrée (1 500 M)Sortie (150M)Total mensuel
Maintenant (jusqu'au 31 décembre)$1,125.00$562.50$1,687.50
À partir du 1er janvier 2027$2,250.00$1,125.00$3,375.00

C'est 1 687,50 $ de plus chaque mois, soit un peu plus de 20 000 $ de plus par an, à partir d'un élément de ligne pricing-docs plutôt que d'un changement de modèle, d'un lancement de fonctionnalité ou d'un pic d'utilisation. Si cette charge de travail est déjà en cours d'exécution sur 3.7 Flash, ce numéro appartient maintenant à un budget T1 2027, non découvert sur la facture de janvier.

Ce que le passage à Flash-Lite permettrait réellement d'économiser

Gemini 3.1 Billets Flash-Lite 0,25 $ / 1,50 $ sans expiration signalée dans les documents de Google. Exécutez les volumes symboliques de la même charge de travail RAG — 1 500 M d'entrée, 150 M de sortie — via Flash-Lite à la place :

Entrée (1 500 M)Sortie (150M)Total mensuel
Flash Gemini 3.7, à partir du 1er janvier$2,250.00$1,125.00$3,375.00
Gemini 3.1 Flash-Lite$375.00$225.00$600.00

That's a 5.6x gap, and it's tempting to read this as "just switch." I wouldn't, not blindly. Flash-Lite is a smaller, cheaper-tier model than Flash — it trades away some of the reasoning and instruction-following headroom that made 3.7 Flash worth picking over it in the first place. The honest move is to run your own eval set through Flash-Lite before the deadline and see whether the answer quality holds up for your specific retrieval-and-answer task. If it does, you bank the $2,775 a month. If it doesn't, you now know that with data instead of guessing, and you budget for the doubled Flash rate with your eyes open.

Ce que je ferais réellement

Anything you've shipped on Gemini 3.7 Flash needs a line in the January 2027 budget today — the rate change is already public, so there's no ambiguity to wait out. Before that date, run your real workload against Flash-Lite and measure the quality delta instead of assuming it either "will obviously be fine" or "obviously won't work." And treat every introductory AI API rate the same way going forward: the discounted number gets you evaluating the model, not a permanent price — check the provider's docs for an expiry line before you build a cost model around launch-week pricing.

Nouveau dans la tarification LLM basée sur l'utilisation ? Commencez par le guides gratuits sur les coûts des API.

Déployez-le vous-même : DigitalOcean — 200 $ de crédit gratuit ↗ · VPS Hostinger ↗

Pricing verified against Google's official Gemini API pricing docs (ai.google.dev/gemini-api/docs/pricing) and our own live rate tracking on apicostcalc.com/gemini.html, checked 2026-09-22. Gemini 3.7 Flash launched September 2, 2026. Reference estimates using Google's published pay-as-you-go rates — Vertex AI pricing, enterprise agreements and future rate changes vary; confirm current pricing at the source before budgeting. Workload figures (request volumes, token counts) are illustrative scenarios computed against real published per-token rates, not vendor-supplied numbers.