Volume de la séance
Coût du jeton par session
Appels d'outils (par exemple, recherche sur le Web)
—
durée d'exécution / mois—jetons / mois
—appels d'outils / mois
—total / mois
Coût par échelle
Le coût d'exécution évolue avec la durée de la session d'horloge murale, quelle que soit la performance du modèle ; Le coût du jeton évolue en fonction de la quantité réellement lue et écrite. Les deux augmentent de manière linéaire avec le nombre de sessions, mais un agent lent paie de manière disproportionnée plus de temps d'exécution par session.
| Séances/mois | Durée d'exécution | Jetons | Outils | Total |
|---|
Pourquoi la facturation à l'heure de session est un élément de campagne distinct ?
Les plates-formes d'agents hébergés facturent de plus en plus l'environnement d'exécution lui-même (le bac à sable, le contexte du navigateur ou le conteneur d'exécution dans lequel l'agent s'exécute) en plus des tarifs des jetons du modèle standard. Un tarif représentatif pour 2026 est d’environ 0,08 $ par heure d’exécution active. Cela ne remplace pas la tarification des jetons, c'est additif : une longue session d'agent paie à la fois pour la durée pendant laquelle son environnement reste provisionné et pour chaque jeton que le modèle sous-jacent lit ou écrit pendant que cet environnement est actif. Deux agents effectuant la même tâche peuvent accumuler des factures très différentes si l'un termine en 90 secondes et l'autre en 8 minutes, même avec un nombre de jetons presque identique, car le plus lent occupe plus longtemps le temps d'exécution facturé.
C'est exactement l'écart entre ce calculateur et un outil de coût d'agent pur par étape ou par jeton : ceux qui fixent le prix des appels du modèle, cela ajoute la dimension qui évolue avec le temps de session plutôt qu'avec le travail effectué. Cela est particulièrement important pour les agents qui attendent des appels d'outils lents, parcourent des pages ou exécutent de longues boucles d'utilisation d'outils : le temps que le modèle passe inactif dans une session active brûle toujours la facturation des heures de session, même s'il brûle très peu de jetons pendant cette attente.
Au-dessus des deux se trouve l’utilisation mesurée de l’outil – un tarif courant en 2026 pour un outil de recherche Web intégré est d’environ 10 $ pour 1 000 recherches. Un agent qui effectue des recherches libérales peut accumuler un coût d'outil significatif, indépendamment de son temps d'exécution et de sa facture de jetons. Le coût total de l'agent en 2026 est en réalité de trois compteurs superposés : heures d'exécution, jetons et appels d'outils - traiter chacun d'entre eux comme "le" coût sous-estime la facture réelle. Pour une vue pure par étape/jeton sans facturation d'exécution, consultez le Calculateur du coût des agents IA ou le calculateur de budget de boucle d'agent pour la planification des coûts incontrôlables du P99.
Calculateur du coût des agents IABudget de boucle d'agentCoût de l'étape de l'agent IACoût de l'agent d'utilisation de l'ordinateurCoût de l’outil de recherche sur le Web
Comment fonctionne cette calculatrice
Calculateur gratuit du coût de session d'un agent géré : modélise la dimension de facturation de l'heure de session 2026 (par exemple, 0,08 $/heure d'exécution active) en plus des taux de jetons d'entrée/sortie standard et des coûts d'outils tels que la recherche sur le Web, afin que vous puissiez voir le coût réel de l'exécution d'un agent hébergé, pas seulement ses jetons.
Questions fréquemment posées
Qu’est-ce que la facturation à l’heure de session pour les agents IA ?
Certains environnements d'exécution d'agent gérés/hébergés facturent désormais des frais horaires pour l'environnement d'exécution actif lui-même (le bac à sable, le navigateur ou le contexte d'exécution dans lequel l'agent opère) séparément du coût des jetons des appels de modèle qu'il effectue. Un tarif représentatif pour 2026 est d’environ 0,08 $ par heure de session d’exécution active. Ceci s'ajoute à la tarification standard des jetons d'entrée/sortie, et ne les remplace pas : une session d'agent de longue durée paie à la fois pour la durée pendant laquelle son environnement reste actif et pour chaque jeton que le modèle lit ou écrit pendant cette période.
En quoi est-ce différent d'un calculateur de coût d'agent par étape ou par jeton ?
Les calculateurs d'agents par étapes et par jetons évaluent les appels du modèle : combien de tours, combien de jetons d'entrée/sortie par tour. Ce calculateur ajoute la dimension qui manque : la charge horaire propre à l'environnement d'exécution, qui évolue en fonction de la durée de la session, et non en fonction de ce que le modèle a réellement fait pendant cette période. Un agent lent qui prend 20 minutes pour terminer une tâche paie 20 minutes de facturation à l'heure de session même s'il a effectué très peu d'appels modèles dans cette fenêtre ; un agent rapide terminant en 2 minutes la même tâche paie beaucoup moins de coûts d'exécution, quel que soit le nombre de jetons. Les deux dimensions comptent et cet outil les modélise ensemble.
Quels autres coûts par utilisation les agents gérés ajoutent-ils généralement ?
Au-delà du coût des heures d'exécution et des jetons, les plates-formes d'agents hébergés mesurent généralement les appels d'outils individuels séparément : un tarif courant en 2026 pour un outil de recherche Web intégré est d'environ 10 $ pour 1 000 recherches. Si la tâche de votre agent implique la navigation, la recherche ou l'appel d'autres outils mesurés, ces coûts par appel s'ajoutent au coût d'exécution et au coût des jetons de la même manière qu'une facture cloud regroupe le calcul, le stockage et la sortie en tant qu'éléments de campagne distincts.