✓ Dernière vérification : 2026-08-15· Source : page officielle des tarifs du fournisseur· Auto-surveillé - signaler un changement →
Un agent ne répond pas en un seul appel, il boucle : réfléchissez, appelez un outil, lisez le résultat, détrompez-vous. Chaque boucle est une demande facturée, le coût est donc multiplié par le nombre d'étapes. Entrez votre utilisation pour voir la facture mensuelle réelle et le modèle le moins cher pour le travail.
Le piège avec les agents : une tâche qui ressemble à une seule question représente en réalité 5 à 20 appels LLM. Un chatbot répond une fois. Un agent raisonne, appelle des outils et relit son propre contexte croissant à chaque étape. Ainsi, le même modèle qui coûte une fraction de centime par message de discussion peut coûter 10 à 50 fois plus que par tâche d'agent. Cette calculatrice le multiplie correctement.
—
par mois
—par tâche
—par année
—Appels LLM / mois
Modèles les moins chers pour cet agent
Même charge de travail, chaque modèle classé par coût mensuel.
Modèle
Coût / mois
Par tâche
⚠️ Estimation à partir des tarifs de référence (juillet 2026) et des tarifs catalogue. Le coût réel de l'agent dépend fortement de la quantité de contexte que vous renvoyez à chaque étape : les agents qui réalimentent l'historique complet augmentent les jetons d'entrée à chaque boucle. Tapez votre nombre réel de jetons par étape pour le chiffre le plus proche. · Signaler un prix obsolète →
Comment le coût de l'agent s'additionne réellement
La formule est tâches × étapes × (jetons d'entrée × prix d'entrée + jetons de sortie × prix de sortie). Le multiplicateur que les gens oublient est mesures: un agent de recherche peut prendre 12 boucles, un agent de codage 20+. Et comme la plupart des agents renvoient la conversation accumulée à chaque étape, saisir des jetons par échelon au fur et à mesure que la tâche avance — le nombre que vous entrez ci-dessus est la moyenne sur toute la boucle. Le résultat est généralement faible par étape (une brève réflexion ou un appel d'outil), c'est pourquoi l'entrée domine la facture de l'agent - et pourquoi la mise en cache rapide et la suppression du contexte sont plus importantes ici que partout ailleurs.
Comment le couper
Quatre leviers, par ordre d’impact : (1) routage du modèle — utiliser un petit modèle pour les étapes de routine et un modèle frontière uniquement pour les étapes difficiles ; (2) capuchon de marche — arrêter les boucles incontrôlées ; (3) découpage du contexte - ne renvoyez pas l'intégralité de l'historique à chaque étape ; (4) mise en cache rapide pour l'invite système statique et les définitions d'outils. Voir le guide de mise en cache rapide et le mise en cache du calculateur d'économies. Construire un chatbot au lieu d’un agent ? Utilisez le calculateur de coût de chatbot. L'application entière ? Le Estimateur du coût des applications d'IA. Exécuter plusieurs agents sur la même tâche : répartition, débat, superviseur ou modèles d'essaim ? Ce calculateur évalue un seul agent ; utiliser le Calculateur du coût des essaims d’agents IA pour voir le multiplicateur que ces modèles d'orchestration ajoutent en plus.
Le Calculateur du coût des agents IA estime les dépenses mensuelles LLM liées à l'exécution d'un agent IA. Parce qu'un agent accomplit chaque tâche en plusieurs étapes Étapes du LLM - tours de raisonnement plus appels d'outils - le coût d'une tâche est le coût du jeton par étape multiplié à chaque étape, puis multiplié à nouveau par votre volume de tâches mensuel. Les principaux moteurs sont votre tâches par mois, le nombre de Étapes LLM par tâche, le jetons d'entrée et de sortie moyens par étape, le modèle vous choisissez (qui fixe le prix par jeton), et tout optimisation comme la mise en cache ou des modèles moins chers. Les petits nombres par étape s'accumulent rapidement à travers les étapes et les tâches.
Le principal compromis à surveiller est nombre de pas par rapport à la qualité du modèle. Un modèle moins cher peut nécessiter plus d'étapes de raisonnement ou de tentatives pour terminer une tâche, donc un prix par jeton inférieur ne signifie pas toujours un total inférieur. Estimez le coût de l'ensemble de la tâche, et non d'un seul appel, et confirmez que le nombre de jetons que vous saisissez reflète les invites réelles : les instructions système longues et les sorties de l'outil sont comptées comme entrées à chaque étape.
Questions fréquemment posées
Pourquoi un agent IA coûte-t-il plus cher qu’un seul appel de chatbot ?
Un agent résout une tâche au cours de nombreux appels LLM : il raisonne, appelle un outil, lit le résultat, raisonne à nouveau et répète. Chaque étape est une demande entièrement facturée, et le contexte d'exécution augmente généralement à chaque étape, de sorte qu'une seule tâche peut coûter 5 à 20 fois une réponse unique d'un chatbot.
Comment puis-je réduire les coûts des agents IA ?
Utilisez un modèle moins cher pour les étapes de routine et réservez un modèle frontière pour les étapes difficiles, limitez le nombre d'étapes par tâche, réduisez le contexte que vous renvoyez à chaque étape et activez la mise en cache des invites pour l'invite système statique et les définitions d'outils qui se répètent à chaque appel.