✓ Dernière vérification : 2026-08-15· Source : page officielle des tarifs du fournisseur· Auto-surveillé - signaler un changement →
Collez le nombre de jetons d’entrée et de sortie et voyez exactement ce que coûte un appel sur chaque modèle majeur – classé le moins cher en premier. Le moyen le plus rapide de comparer GPT, Claude, Gemini et DeepSeek sur les prix.
Les fournisseurs évaluent séparément les jetons d’entrée et de sortie – et la production coûte généralement 3 à 5 fois plus que l’entrée. Ainsi, une courte invite avec une réponse longue peut coûter plus cher qu’une longue invite avec une réponse courte. Entrez vos deux numéros et voyez le coût réel par appel sur tous les modèles.
—
moins cher / appeler
—modèle le moins cher
—total pour les appels
—jetons / appel
Coût par appel par modèle
Votre jeton compte, chaque modèle est classé en premier. Les prix sont par million de jetons.
Modèle
En $/1M
Sortie $/1 M
Coût / appel
⚠️ Estimation à partir des tarifs de référence (juillet 2026) et des tarifs catalogue. Les prix réels changent et varient en fonction du niveau, de la région, de la durée du contexte et des remises sur la mise en cache/par lots. Pour un contexte répété, voir mise en cache des invites ; pour les tâches asynchrones en masse, consultez la tarification par lots. · Signaler un prix obsolète →
Comment fonctionne le coût des jetons
La formule est simple : coût = (jetons d'entrée ÷ 1 000 000 × prix d'entrée) + (jetons de sortie ÷ 1 000 000 × prix de sortie). Les deux prix sont volontairement différents : générer du texte (sortie) coûte plus cher que le lire (entrée), généralement de 3 à 5 fois. C'est pourquoi le plus gros levier sur votre facture est généralement longueur de sortie de plafonnement, sans couper l'invite. À titre indicatif, 1 000 jetons ≈ 750 mots anglais, mais le code et les autres langages sont tokenisés différemment, alors mesurez avec le tokenizer du fournisseur pour obtenir des chiffres exacts.
Le Calculateur du coût des jetons LLM estime le coût d'un appel d'API à modèle de langage unique en fonction du nombre de jetons d'entrée vous envoyez et le jetons de sortie le modèle revient. Étant donné que les fournisseurs évaluent les jetons d’entrée et de sortie à des taux par million différents, les deux comptes déterminent le total, et les jetons de sortie sont généralement les plus chers des deux. Vous pouvez également saisir un nombre d'appels pour projeter le coût sur de nombreuses demandes identiques. L'outil applique les tarifs publiés de chaque modèle, puis classe les résultats le moins cher d'abord entre fournisseurs tels que GPT, Claude, Gemini et DeepSeek, afin que vous puissiez comparer la même charge de travail côte à côte.
Le principal compromis à surveiller est que le prix par jeton le plus bas n’est pas toujours le coût réel le plus bas. Un modèle qui produit des réponses plus longues et plus détaillées peut brûler plus de jetons de sortie et finir par être plus cher qu'un modèle nominalement plus cher. Estimez avec un nombre de jetons qui reflète votre réel les invites et la longueur de réponse typique, car un test court prédit rarement le volume de production. Revérifiez le classement chaque fois que la taille de votre invite, le résultat attendu ou la fréquence des appels change, car l'option la moins chère peut changer à mesure que l'une de ces entrées évolue.
Questions fréquemment posées
Comment le coût du jeton LLM est-il calculé ?
Coût = (jetons d'entrée / 1 000 000 × prix d'entrée) + (jetons de sortie / 1 000 000 × prix de sortie). Les fournisseurs évaluent séparément les entrées et les sorties, et les sorties sont généralement 3 à 5 fois plus chères que les entrées, de sorte que les réponses longues coûtent plus cher que les invites longues.
Combien de jetons représente un mot ?
Pour l'anglais, environ 1 jeton équivaut à environ 0,75 mot, donc 1 000 jetons correspondent à environ 750 mots. Le code, les nombres et les autres langues sont tokenisés différemment, alors mesurez toujours avec le tokenizer du fournisseur pour obtenir des décomptes exacts.