moins cher par correct
prime / correct
moins cher / correct
précision du seuil de rentabilité

Prix ​​de la vignette vs prix d'un résultat

Chaque modèle est tarifé de deux manières : le coût brut par appel et le coût effectif une fois divisé par précision pour payer les tentatives. La colonne « nouvelles tentatives » est celle de la précision : combien de tentatives sont nécessaires en moyenne pour obtenir une bonne réponse. La ligne la moins chère par correct est mise en surbrillance ; ce n'est pas toujours l'autocollant le moins cher.

Modèle$/appelPrécisionTentatives/corrections$/correctMensuel

De quelle précision le modèle le moins cher a-t-il besoin

Le coût effectif du modèle le moins cher pour une gamme de précisions, par rapport au coût fixe par correction du modèle haut de gamme. La ligne où ils se croisent est la précision du seuil de rentabilité : au-dessus, le modèle le moins cher gagne, en dessous, ses tentatives en font le choix le plus cher.

Précision moins chèreMoins cher $/correctPrime $/correctGagnant

La remise qui vous coûte de l'argent

Chaque tableau de bord de sélection de modèles trie par prix par million de jetons, et chacun d'entre eux répond à la mauvaise question. Le coût qui apparaît sur votre facture n’est pas le coût d’un appel, c’est le coût d’un appel que vous pouvez réellement utiliser – et dès que votre tâche a une bonne et une mauvaise réponse, ces deux chiffres se séparent. Un modèle 30 % moins cher par appel mais dix points moins précis n’est pas 30 % moins cher ; une fois que vous réessayez ou rejetez ses erreurs, vous achetez plus de tentatives par résultat utilisable, et l'arithmétique peut complètement inverser le classement. La solution est une division : prenez le coût d'une tentative et divisez-le par la probabilité que la tentative soit bonne, et comparez les modèles sur ce point. Le seuil de rentabilité imprimé par cette calculatrice représente l'ensemble de la décision en un seul chiffre : la précision qu'un modèle moins cher doit atteindre avant que sa remise ne soit réelle plutôt qu'une taxe que vous payez en tentatives. Cela suppose que vous puissiez distinguer le bien du mal et simplement réexécuter les échecs, ce qui est exactement le cas lorsque vous disposez d'une suite de tests, d'un vérificateur ou d'un examen humain ; Si de mauvaises réponses sont expédiées sans être détectées, le modèle bon marché est encore pire, car vous payez désormais également le prix d'une erreur en aval. Tarifez d'abord un seul appel avec le calculateur de coût symbolique, comparez les prix bruts des modèles sur le page de comparaison de modèles, et si vous enchaînez les appels vers un agent, dimensionnez la gravure du jeton de tâche complète avec le Calculateur du coût des agents IA.

Hébergez votre projet :DigitalOcean — 200 $ gratuits ↗VPS Hostinger
Coût du jetonPrix ​​/ PerformanceCoût des tests A/BCoût de l'agent IAComparaison des modèles