HomeBlog › Déflation des prix LLM et votre budget

Votre budget IA est probablement erroné : les prix des LLM chutent d'environ 10 fois par an

Publié le 11/07/2026 · basé sur notre nouveau Suivi de l'historique des prix LLM — chaque événement de prix majeur depuis GPT-4, avec des dates

Nous avons compilé tous les changements majeurs de prix de l'API LLM de mars 2023 à aujourd'hui en un seul. chronologie. Le modèle est plus cohérent que prévu et il casse la plupart des feuilles de calcul de budget IA que nous avons vues : à capacité constante, les prix chutent d’environ 10 fois par an. Pas progressivement – ​​par étapes, et généralement dans des directions que personne n’avait prédites.

Trois chiffres qui racontent une histoire

DateEntrée de classe frontière, $/1 Mvs lancement de GPT-4
Mars 2023 (GPT-4)$30.00
Août 2024 (GPT-4o après coupure)$2.50−92%
2026 (hôtes à poids ouvert)<1,00 $−97%

Prix ​​catalogue historiques. Chronologie complète avec 14 événements datés sur le page historique des prix.

Le mécanisme est important : les modèles individuels sont rarement moins chers (les deux coupes du GPT-4o étaient l'exception). Ce qui se passe réellement, c'est remplacement — chaque nouvelle génération est livrée au niveau inférieur de la génération précédente. Le GPT-4o mini bat le GPT-3.5 Turbo à un tiers de son prix. DeepSeek V2 a offert une qualité proche de la frontière à 0,14 $. On ne surmonte pas la déflation en attendant des rabais ; vous le montez en ré-achetant le niveau.

Qu'est-ce que ça casse

Contrats annuels aux tarifs d'aujourd'hui. Une remise sur volume de 30 % bloquée pendant 12 mois est une perte si les prix du marché chutent de 60 à 90 % au cours de cette fenêtre – et c’est historiquement le cas. Tout engagement de plus de 6 à 12 mois est un pari contre une tendance sur trois ans. Si vous devez vous engager, engagez-vous à dépenser, et non à respecter la grille tarifaire d'un modèle spécifique.

"L'IA est trop chère pour cette fonctionnalité". Une fonctionnalité qui coûte aujourd'hui 10 000 $/mois coûtera vraisemblablement entre 1 et 3 000 $ à qualité égale dans 18 mois. L’économie des unités marginales signifie désormais généralement une bonne économie des unités bientôt – le calcul construction/attente devrait inclure la courbe, et pas seulement l’autocollant d’aujourd’hui.

Intégration approfondie d’un seul fournisseur. Les deux chocs de prix discontinus sur notre chronologie (mai 2024, janvier 2025) provenaient de DeepSeek – un étranger. Les équipes avec un routage indépendant du fournisseur ont capturé ces prix en quelques jours ; des équipes soudées à un SDK surveillées de côté. Le coût d’ingénierie d’une couche d’abstraction constitue une prime d’assurance lors du prochain choc.

Ce que la tendance ne dit PAS

Deux mises en garde honnêtes à partir des données. D'abord, les prix à la production baissent plus lentement — GPT-4 lancé avec sortie à 2× entrée ; aujourd'hui, les ratios 4 à 5 × sont la norme. Les charges de travail lourdes (génération de code, réponses longues) se dégonflent beaucoup plus lentement que le titre. Deuxième, les prix augmentent: Claude 3.5 Haiku a été lancé à 3,2 fois le prix de son prédécesseur car il se comparait à un modèle de milieu de gamme. Le niveau bon marché qui reste bon marché est une habitude, pas une garantie – ne le codez jamais en dur.

La routine pratique

Trimestriel, quinze minutes : mettez votre véritable mélange de jetons dans le Plus de 300 modèles de comparaison et vérifiez si votre modèle actuel gagne toujours son niveau. Quand ce n'est pas le cas, le calculateur d'économies de baisse de prix prix la migration. La plupart des équipes que nous modélisons réalisent des économies de 30 à 60 % la première fois qu'elles le font – de l'argent qui était sur la table simplement parce que le choix du modèle a été fait il y a deux trimestres.

Tous les chiffres sont des prix catalogue historiques, compilés en juillet 2026 — détails et sources sur le page historique des prix. En rapport: Comparaison des prix des modèles d'IA · Économies de routage du modèle · API LLM la moins chère.