Publié le 30/06/2026 · prix de référence, vérifier avant de budgétiser
La guerre des prix LLM 2026 prend une nouvelle forme : Grok de xAI s'est imposé dans la conversation en tant que leader en matière de coûts, OpenAI et Google se sont divisés en niveaux budgétaires et premium clairs, et Claude d'Anthropic se situe toujours au sommet de l'échelle des prix. Pour rendre la comparaison honnête, nous avons fait ce que nous faisons toujours : fixer une charge de travail et la fixer sur chaque modèle majeur. Le métier : 1 000 000 de demandes, chaque 1 000 jetons d'entrée et 500 jetons de sortie (une courte conversation ou un appel de génération typique). Cela représente 1 milliard de jetons d'entrée et 500 millions de jetons de sortie.
| Modèle | En $/1M | Sortie $/1 M | Coût pour 1 million de demandes |
|---|---|---|---|
| Grok 4.1 Rapide frontière la moins chère | $0.20 | $0.50 | $450 |
| Recherche profonde V3 | $0.27 | $1.10 | $820 |
| GPT-5.4 mini | $0.40 | $1.60 | $1,200 |
| Gémeaux 2.5 Flash | $0.30 | $2.50 | $1,550 |
| Gémeaux 3.1 Pro | $2.00 | $12.00 | $8,000 |
| GPT-5.4 | $2.50 | $15.00 | $10,000 |
| Grok 4 (phare) | $3.00 | $15.00 | $10,500 |
| Claude Opus 4.6 | $5.00 | $25.00 | $17,500 |
Les prix sont des estimations de référence, juillet 2026. Signaler un prix obsolète →
Même charge de travail, 450 $ sur Grok 4.1 Fast contre 17 500 $ sur Claude Opus 4.6 - un ~39× propagation. La décision la plus importante concernant votre facture d’IA reste le modèle vers lequel vous vous dirigez, et en 2026, l’extrémité bon marché de la frontière est passée à xAI.
Grok est devenu agressif sur les prix. Le niveau Fast de xAI à 0,20 $/0,50 $ réduit même DeepSeek en termes de sortie et se situe bien en dessous de tous les modèles de frontière occidentale – un accaparement délibéré de terres, associé à une immense fenêtre contextuelle et à des données X en direct. OpenAI et Google ont bifurqué. Chacun a désormais un petit modèle vraiment bon marché (GPT-5.4 mini, Gemini 2.5 Flash) et un produit phare coûteux (GPT-5.4, Gemini 3.1 Pro), alors « lequel est le moins cher, OpenAI ou Google ? cela dépend entièrement du niveau dont vous parlez. Claude est resté premium. Opus reste le jeton le plus cher des majors – Anthropic mise sur la capacité et la fiabilité, et non sur le leadership en matière de coûts. Si votre budget est la contrainte, Claude Haiku (beaucoup moins cher) est le niveau à considérer, pas Opus.
Le numéro qui remporte ce tableau ne remporte pas automatiquement votre projet. Un modèle moins cher qui nécessite une nouvelle tentative, écrit des réponses plus longues ou échoue aux invites difficiles peut coûter plus cher en pratique qu'un modèle plus cher qui réussit du premier coup. La longueur de sortie compte également : la sortie est facturée 2,5 à 5 fois l'entrée sur chaque modèle ici, de sorte qu'un modèle bon marché et verbeux peut perdre face à un modèle coûteux et laconique. Le modèle sur lequel la plupart des équipes choisissent est hiérarchisation: acheminez le trafic de routine et à volume élevé vers un modèle bon marché (Grok Fast, Gemini Flash, DeepSeek) et faites remonter uniquement les demandes véritablement difficiles vers un produit phare. Même l’envoi de 20 % des appels vers un modèle premium maintient votre coût global proche du bas de gamme du tableau.
Une fois le modèle choisi, trois éléments font bouger la facture : plafonds de sortie (ensemble max_tokens — la production est la moitié la plus chère), mise en cache rapide (les invites système répétées sont facturées à un prix très réduit sur OpenAI, Anthropic, Grok et DeepSeek), et routage (bon marché d'abord, intensifier en fonction de l'incertitude). Chacun se compose avec les autres. Modélisez les économies avec le calculateur de mise en cache rapide et le calculateur de routage modèle.
Vos jetons ne nous appartiennent pas, le classement peut donc basculer en fonction d'un trafic à forte production ou à forte entrée. Branchez vos véritables longueurs d'entrée/sortie et votre volume dans le Classement API LLM le moins cher — il trie chaque modèle pour ton nombres - ou le Calculateur de coût de l'API IA. Construire quelque chose de spécifique ? Utilisez le Estimateur du coût des applications d'IA, et si vous revendez AI dans le cadre d'un abonnement, le Calculateur de prix de wrapper IA indique si votre prix compense réellement le coût de l'API. Guides par fournisseur : Grok, OpenAI, Claude, Gémeaux, Recherche profonde.
Ouvrez le classement API LLM le moins cher → · OpenAI contre Claude contre Gémeaux →
Prix de référence (juin 2026), recueillis à partir de pages de tarification publiques et de comparaisons de fournisseurs ; les noms des modèles et les tarifs changent souvent – vérifiez avant de budgétiser. Non affilié à aucun fournisseur.