✓ Dernière vérification : 2026-07-27· Modèle : coût effectif ajusté avec précision· signaler un problème →
Le prix du jeton est le coût d'un appel, pas utilisable résultat. Un modèle moins cher et qui convient moins souvent vous fait payer pour les tentatives – donc c'est vrai coût par bonne réponse peut battre un modèle plus cher, ou perdre contre lui. Entrez le coût par tâche et la précision de chaque modèle pour voir le coût ajusté en fonction de la précision, le précision du seuil de rentabilité, et quel modèle est réellement moins cher par sortie correcte.
—
moins cher par correct
—prime / correct
—moins cher / correct
—précision du seuil de rentabilité
Prix de la vignette vs prix d'un résultat
Chaque modèle est tarifé de deux manières : le coût brut par appel et le coût effectif une fois divisé par précision pour payer les tentatives. La colonne « nouvelles tentatives » est celle de la précision : combien de tentatives sont nécessaires en moyenne pour obtenir une bonne réponse. La ligne la moins chère par correct est mise en surbrillance ; ce n'est pas toujours l'autocollant le moins cher.
Modèle
$/appel
Précision
Tentatives/corrections
$/correct
Mensuel
De quelle précision le modèle le moins cher a-t-il besoin
Le coût effectif du modèle le moins cher pour une gamme de précisions, par rapport au coût fixe par correction du modèle haut de gamme. La ligne où ils se croisent est la précision du seuil de rentabilité : au-dessus, le modèle le moins cher gagne, en dessous, ses tentatives en font le choix le plus cher.
Précision moins chère
Moins cher $/correct
Prime $/correct
Gagnant
La remise qui vous coûte de l'argent
Chaque tableau de bord de sélection de modèles trie par prix par million de jetons, et chacun d'entre eux répond à la mauvaise question. Le coût qui apparaît sur votre facture n’est pas le coût d’un appel, c’est le coût d’un appel que vous pouvez réellement utiliser – et dès que votre tâche a une bonne et une mauvaise réponse, ces deux chiffres se séparent. Un modèle 30 % moins cher par appel mais dix points moins précis n’est pas 30 % moins cher ; une fois que vous réessayez ou rejetez ses erreurs, vous achetez plus de tentatives par résultat utilisable, et l'arithmétique peut complètement inverser le classement. La solution est une division : prenez le coût d'une tentative et divisez-le par la probabilité que la tentative soit bonne, et comparez les modèles sur ce point. Le seuil de rentabilité imprimé par cette calculatrice représente l'ensemble de la décision en un seul chiffre : la précision qu'un modèle moins cher doit atteindre avant que sa remise ne soit réelle plutôt qu'une taxe que vous payez en tentatives. Cela suppose que vous puissiez distinguer le bien du mal et simplement réexécuter les échecs, ce qui est exactement le cas lorsque vous disposez d'une suite de tests, d'un vérificateur ou d'un examen humain ; Si de mauvaises réponses sont expédiées sans être détectées, le modèle bon marché est encore pire, car vous payez désormais également le prix d'une erreur en aval. Tarifez d'abord un seul appel avec le calculateur de coût symbolique, comparez les prix bruts des modèles sur le page de comparaison de modèles, et si vous enchaînez les appels vers un agent, dimensionnez la gravure du jeton de tâche complète avec le Calculateur du coût des agents IA.
Il prend le coût par tâche de chaque modèle et sa précision comme taux de réussite. Le coût effectif par bonne réponse est le coût par tâche divisé par la fraction de précision – car en moyenne, vous effectuez une tentative de précision pour obtenir une bonne réponse, et vous payez également pour les tentatives infructueuses. Les dépenses mensuelles effectives correspondent au coût par bonne réponse multiplié par le nombre de bonnes réponses dont vous avez besoin par mois (réponses correctes par jour multipliées par 30,4). La précision du seuil de rentabilité est la précision du modèle le plus cher, proportionnée au rapport entre le coût du modèle le moins cher et le coût du modèle premium – la précision avec laquelle les tentatives du modèle le moins cher annulent exactement son avantage en termes de prix. Cela suppose des tentatives indépendantes et un moyen fiable de détecter une mauvaise réponse ; sans vérificateur, le coût effectif est une limite inférieure.
Questions fréquemment posées
Qu’est-ce que le coût par bonne réponse et pourquoi est-il plus important que le prix symbolique ?
C'est ce que vous payez pour obtenir un résultat utilisable, et non ce que coûte un appel. Le prix du jeton ne dit rien sur la réussite de la tentative. Si un modèle réussit 70 % du temps et que vous réessayez les échecs, vous payez environ 1,4 tentatives par bonne réponse, donc son coût effectif est l'autocollant divisé par la précision. Cette division peut inverser le classement : un modèle 40 % moins cher par appel mais moins précis peut être plus cher par bonne réponse qu'un modèle plus cher et plus fiable.
Comment calculer le coût ajusté en fonction de la précision d'un modèle ?
Divisez le coût d’un appel par le taux de réussite sous forme de fraction. Deux cents à 95 % représentent environ 2,1 cents par bonne réponse ; deux cents à 65 % équivaut à environ 3,1 cents, car environ 1,5 appels sont nécessaires pour un bon. Le multiplicateur est de un sur la précision : 95 % correspond à une taxe de 1,05x, 65 % une taxe de 1,54x, 50 % double votre coût. Cela suppose que vous pouvez détecter les mauvaises réponses et réessayer ; si de mauvaises réponses sont expédiées, le coût réel est plus élevé.
De quelle précision un modèle moins cher a-t-il besoin pour être réellement moins cher ?
Au moins la précision du modèle le plus cher adaptée au rapport prix. Si le modèle premium est précis à 95 % et que le modèle le moins cher coûte 70 % plus cher, le moins cher a besoin d’une précision d’environ 66,5 % pour atteindre le seuil de rentabilité. En dessous, ses tentatives consomment l’économie ; au-dessus, il gagne. Une remise globale n’a aucun sens sans un numéro de précision joint.
Cela s'applique-t-il également à la classification, à l'extraction et aux agents ?
Partout où vous pouvez déterminer si une sortie est correcte. La précision est votre taux de réussite par rapport à un ensemble étiqueté, ou la fraction d'exécutions d'agents qui atteignent un résultat correct. Pour les agents, l’effet est amplifié : une exécution ratée peut brûler bien plus de jetons qu’un seul appel. Pour une génération ouverte, utilisez le taux d'acceptation (part conservée sans réécriture) comme entrée de précision.