—
choix au meilleur rapport qualité/prix
—mixte $/1M
—votre coût mensuel
—score de valeur
Modèles classés
Le prix mixte utilise votre rapport entrées/sorties. Score de valeur = intelligence ÷ prix pondéré, normalisé pour que le leader soit 100. L'intelligence est un indice de référence et non une référence faisant autorité.
| Modèle | Entrée/Sortie $/1M | Mixte $/1M | QI* | Valeur | Votre $/mois |
|---|
⚠️ L'indice d'intelligence (marqué IQ*) est une référence directionnelle pour 2026, et non une autorité de référence : les classements des modèles changent avec les nouvelles versions et dépendent de la tâche. Les prix sont des tarifs publiés au fur et à mesure par million de jetons et excluent les remises sur la mise en cache, les lots et les volumes. Validez toujours vos deux ou trois meilleurs choix sur votre propre ensemble d’évaluation avant de vous engager. ·
Signaler un prix obsolète →
Le prix global cache la vraie décision
Comparer les LLM sur leur prix d'entrée par million de jetons est la manière dont fonctionnent la plupart des tableaux de coûts, et cela est trompeur de deux manières. Premièrement, les jetons de sortie coûtent généralement trois à cinq fois plus cher que les entrées, donc un modèle qui semble bon marché en entrée peut être coûteux pour une charge de travail qui écrit de longues réponses. Deuxièmement, le prix ne dit rien sur la capacité – l’intérêt du modèle. Un outil qui coûte un dixième du prix mais qui échoue à un tiers de vos tâches n'est pas bon marché ; c'est cher une fois que l'on compte les tentatives et le nettoyage humain. Le rapport prix/performance regroupe les deux problèmes en un seul chiffre : un score de capacité divisé par le mélangé prix de votre mélange de jetons réel, vous comparez donc la valeur, pas seulement le coût.
Ce recadrage change les décisions. Pour les travaux volumineux et indulgents (classification, marquage, extraction de la première ébauche), le choix le plus avantageux est souvent un modèle petit ou ouvert qui est presque aussi performant que Frontier pour une fraction du prix. Pour les travaux où une erreur est coûteuse – code de production, rédaction juridique ou médicale, actions des agents – le calcul de la valeur favorise à juste titre un modèle plus solide, car son score plus élevé dépasse la prime. Le modèle intelligent sur lequel la plupart des équipes atterrissent est de itinéraire demandes faciles au leader de valeur et réserver un modèle frontière aux plus difficiles. Une fois que vous avez choisi, dimensionnez la vraie facture sur le Calculateur du coût des jetons LLM et coupez-le davantage avec mise en cache rapide.
Comment l'utiliser
1. Entrez les jetons d'entrée et de sortie typiques pour une demande - cela définit votre répartition des coûts réels.
2. Ajoutez éventuellement des demandes mensuelles pour connaître le coût en dollars de chaque modèle pour votre charge de travail.
3. Choisissez si vous souhaitez classer par valeur, prix brut ou intelligence, et lisez le tableau. Le leader en termes de valeur est le modèle offrant le plus de capacités par dollar pour ton forme de jeton.
Erreurs courantes
À en juger uniquement par le prix des intrants. Les travaux exigeants en termes de production sont tarifés en fonction du taux de production : définissez votre ratio réel. À la recherche du moins cher absolu. Si votre tâche échoue, la refonte coûte plus cher que les jetons économisés. Trop payer pour un modèle frontière partout. La plupart des demandes n'en ont pas besoin ; réservez-le pour la tranche dure. Faire confiance à un score. L'indice d'intelligence est un point de départ : la seule référence qui compte est votre propre évaluation basée sur vos propres invites.
Estimation seulement. L'indice d'intelligence est une référence directionnelle ; validez sur vos propres tâches avant de choisir.
Affinement vs invitePrévision des coûts des APICalculateur de coûts de réglage finCalculateur de coût d'intégrationAPI LLM la moins chère
Comment fonctionne cette calculatrice
Le Calculateur prix/performance IA estime le coût par requête d'exécution d'un modèle de langage et classe les fournisseurs tels que GPT-5, Claude, Gemini, Grok, DeepSeek et Llama par intelligence par dollar plutôt que le prix symbolique brut seul. Vous entrez dans le jetons d'entrée et jetons de sortie par requête, et l'outil multiplie chacun par les taux respectifs du modèle, car les jetons de sortie ont généralement un prix plus élevé que les jetons d'entrée. Il combine ensuite ce coût avec les performances de référence de chaque modèle pour produire un classement de valeur, vous permettant de comparer un modèle bon marché mais plus faible à un modèle plus cher mais plus solide sur une échelle unique que vous choisissez avec le Classer par option.
Cela est important car le prix symbolique le plus bas n'est pas toujours la meilleure affaire : un modèle plus faible peut nécessiter de nouvelles tentatives, des invites plus longues ou davantage de résultats pour atteindre le même résultat, ce qui augmente son coût réel. En liant le prix à la capacité mesurée, le calculateur vous aide à adapter un modèle à votre charge de travail et à votre budget. Gardez à l’esprit que l’estimation reflète le nombre de jetons que vous saisissez, donc une demande réelle typique est plus utile qu’un meilleur cas, et les taux et les références publiés changent suffisamment souvent pour justifier une nouvelle vérification avant de vous engager.
Questions fréquemment posées
Quel est le rapport prix/performance pour un LLM ?
Le rapport prix/performance mesure la capacité du modèle que vous obtenez pour chaque dollar dépensé, plutôt que de considérer uniquement le prix brut du jeton. Un modèle peut être très bon marché mais faible, ou cher mais légèrement plus intelligent qu'une option de niveau intermédiaire. En divisant un score de capacité par le coût combiné par million de jetons, on obtient un score de valeur : plus le score est élevé, plus il y a d'intelligence par dollar. C'est le nombre qui compte réellement lorsque vous choisissez un modèle pour une charge de travail réelle avec un budget limité.
Pourquoi le rapport entrées/sorties change-t-il le classement ?
La plupart des modèles facturent beaucoup plus pour les jetons de sortie que pour les jetons d'entrée, souvent trois à cinq fois plus. Ainsi, le prix effectif d'un modèle dépend fortement du fait que votre charge de travail soit lourde en entrées (invites longues, réponses courtes, comme la classification ou l'extraction) ou en sortie (invites courtes, générations longues, comme l'écriture ou le code). La définition de votre rapport entrée/sortie réel mélange les deux prix dans le coût que vous paierez réellement, ce qui peut réorganiser considérablement le classement des valeurs par rapport à une comparaison naïve des prix affichés.
Comment est déterminé le score d’intelligence ?
Le calculateur utilise un indice d'intelligence de référence – une note approximative de 0 à 100 basée sur la position générale de chaque modèle dans les références publiques de raisonnement, de codage et de connaissances en 2026. Il s'agit d'un guide directionnel, et non d'une référence faisant autorité, car les classements changent avec les nouvelles versions et dépendent de la tâche. Pour un cas d'utilisation spécifique, vous devez valider les deux ou trois premiers choix de valeurs sur votre propre ensemble d'évaluation plutôt que de vous fier à un seul score composite.
Le modèle le moins cher est-il toujours le meilleur rapport qualité-prix ?
Souvent, mais pas toujours. Les modèles les moins chers peuvent gagner en valeur pour des tâches simples et volumineuses pour lesquelles une qualité proche de la frontière n'est pas nécessaire. Mais si une tâche échoue avec une qualité médiocre, les nouvelles tentatives, les corrections humaines et les erreurs en aval coûtent bien plus cher que les économies de jetons, de sorte qu'un modèle légèrement plus cher mais plus performant offre une meilleure valeur réelle. La meilleure pratique consiste à acheminer les demandes faciles vers le choix le plus rentable et à réserver un modèle frontière pour les plus difficiles – le classement par valeur vous aide à choisir les deux.