Le piège avec les agents : une tâche qui ressemble à une seule question représente en réalité 5 à 20 appels LLM. Un chatbot répond une fois. Un agent raisonne, appelle des outils et relit son propre contexte croissant à chaque étape. Ainsi, le même modèle qui coûte une fraction de centime par message de discussion peut coûter 10 à 50 fois plus que par tâche d'agent. Cette calculatrice le multiplie correctement.

par mois
par tâche
par année
Appels LLM / mois

Modèles les moins chers pour cet agent

Même charge de travail, chaque modèle classé par coût mensuel.

ModèleCoût / moisPar tâche
⚠️ Estimation à partir des tarifs de référence (juillet 2026) et des tarifs catalogue. Le coût réel de l'agent dépend fortement de la quantité de contexte que vous renvoyez à chaque étape : les agents qui réalimentent l'historique complet augmentent les jetons d'entrée à chaque boucle. Tapez votre nombre réel de jetons par étape pour le chiffre le plus proche. · Signaler un prix obsolète →

Comment le coût de l'agent s'additionne réellement

La formule est tâches × étapes × (jetons d'entrée × prix d'entrée + jetons de sortie × prix de sortie). Le multiplicateur que les gens oublient est mesures: un agent de recherche peut prendre 12 boucles, un agent de codage 20+. Et comme la plupart des agents renvoient la conversation accumulée à chaque étape, saisir des jetons par échelon au fur et à mesure que la tâche avance — le nombre que vous entrez ci-dessus est la moyenne sur toute la boucle. Le résultat est généralement faible par étape (une brève réflexion ou un appel d'outil), c'est pourquoi l'entrée domine la facture de l'agent - et pourquoi la mise en cache rapide et la suppression du contexte sont plus importantes ici que partout ailleurs.

Comment le couper

Quatre leviers, par ordre d’impact : (1) routage du modèle — utiliser un petit modèle pour les étapes de routine et un modèle frontière uniquement pour les étapes difficiles ; (2) capuchon de marche — arrêter les boucles incontrôlées ; (3) découpage du contexte - ne renvoyez pas l'intégralité de l'historique à chaque étape ; (4) mise en cache rapide pour l'invite système statique et les définitions d'outils. Voir le guide de mise en cache rapide et le mise en cache du calculateur d'économies. Construire un chatbot au lieu d’un agent ? Utilisez le calculateur de coût de chatbot. L'application entière ? Le Estimateur du coût des applications d'IA. Exécuter plusieurs agents sur la même tâche : répartition, débat, superviseur ou modèles d'essaim ? Ce calculateur évalue un seul agent ; utiliser le Calculateur du coût des essaims d’agents IA pour voir le multiplicateur que ces modèles d'orchestration ajoutent en plus.

Hébergez votre projet :DigitalOcean — 200 $ gratuits ↗VPS Hostinger
Calculateur de coût d'évaluation LLMCalculateur du coût de génération de données synthétiquesLicence de siège AI et calculateur de coût APICalculateur de temps et de coûts de traitement par lotsCalculateur du coût de l'IA par utilisateur