Volume della sessione
Costo del token per sessione
Chiamate a strumenti (ad esempio ricerca sul Web)
—gettoni/mese
—chiamate utensili/mese
—totale/mese
Costo per scala
Il costo di runtime varia in base alla durata della sessione, indipendentemente da quanto ha fatto il modello; il costo del token varia in base a quanto effettivamente letto e scritto. Entrambi crescono linearmente con il conteggio delle sessioni, ma un agente lento paga in modo sproporzionato più tempo di esecuzione per sessione.
| Sessioni/mese | Durata | Gettoni | Utensili | Totale |
|---|
Perché la fatturazione per ora di sessione è una voce separata
Le piattaforme con agenti ospitati fatturano sempre più l'ambiente di runtime stesso (il sandbox, il contesto del browser o il contenitore di esecuzione all'interno dell'agente viene eseguito) oltre alle tariffe dei token del modello standard. Una tariffa rappresentativa per il 2026 è di circa $ 0,08 per ora di tempo di esecuzione attivo. Questo non sostituisce il prezzo dei token, è aggiuntivo: una lunga sessione dell'agente paga sia per il tempo in cui il suo ambiente rimane fornito sia per ogni token che il modello sottostante legge o scrive mentre quell'ambiente è attivo. Due agenti che svolgono la stessa attività possono accumulare fatture molto diverse se uno termina in 90 secondi e l'altro impiega 8 minuti, anche con conteggi di token quasi identici, perché quello più lento occupa il tempo di esecuzione fatturato più a lungo.
Questo è esattamente il divario tra questo calcolatore e un puro strumento di costo agente per passaggio o per token: quelli chiamano il prezzo del modello, questo aggiunge la dimensione che si adatta al tempo trascorso nella sessione piuttosto che al lavoro svolto. È particolarmente importante per gli agenti che attendono chiamate lente agli strumenti, sfogliano pagine o eseguono lunghi cicli di utilizzo degli strumenti: il tempo che il modello trascorre inattivo all'interno di una sessione attiva brucia comunque la fatturazione per ora di sessione anche se brucia pochissimi token durante quell'attesa.
Oltre a entrambi c’è l’utilizzo misurato degli strumenti: una tariffa comune nel 2026 per uno strumento di ricerca web integrato è di circa $ 10 per 1.000 ricerche. Un agente che effettua ricerche liberamente può accumulare costi significativi per gli strumenti indipendentemente sia dal tempo di esecuzione che dalla fattura simbolica. Il costo totale degli agenti nel 2026 ammonta in realtà a tre contatori: ore di autonomia, token e chiamate agli strumenti: trattare uno qualsiasi di essi come "il" costo sottostima il conto reale. Per la visualizzazione pura per passaggio/token senza fatturazione di runtime, vedere il file Calcolatore dei costi dell'agente AI o il calcolatore del budget del loop dell'agente per la pianificazione dei costi fuori controllo P99.
Calcolatore dei costi dell'agente AIBudget del ciclo dell'agenteCosto in passi dell'agente AICosto dell'agente per l'utilizzo del computerCosto dello strumento di ricerca Web
Come funziona questa calcolatrice
IL Calcolatore dei costi delle sessioni dell'agente gestito stima il costo mensile effettivo di gestione di un agente ospitato, non solo la spesa in token. Combina tre dimensioni di fatturazione: a tariffa oraria per sessione addebitato per ora di autonomia attiva (ad esempio, $ 0,08), standard tariffe dei token di input e output prezzo per milione di token e per-ricerca tariffe degli strumenti. Inserisci le sessioni al giorno, la durata media della sessione, i giorni attivi al mese, i token di input e output per sessione, i due prezzi dei token e le ricerche per sessione. La calcolatrice li moltiplica in modo da poter vedere come tempo di esecuzione, il volume del token e le chiamate allo strumento contribuiscono ciascuno al totale.
Il compromesso chiave da tenere d’occhio è durata della sessione. Poiché il tempo di esecuzione viene fatturato su base oraria, un agente di lunga durata che resta inattivo tra un passaggio e l'altro può costare più di quanto suggeriscono i token, poiché si paga per il tempo impiegato indipendentemente dal fatto che il modello stia generando o meno. Se gli addebiti per ora di sessione dominano il totale, abbreviare le sessioni, chiuderle tempestivamente o lavorare in batch spesso consente di risparmiare più della riduzione dei token. Se prevalgono le spese simboliche, concentrati invece su lunghezza di uscita e frequenza di ricerca. Modifica gli input per scoprire quale conducente controlla effettivamente la tua bolletta.
Domande frequenti
Che cos'è la fatturazione per ora di sessione per gli agenti AI?
Alcuni runtime di agenti gestiti/ospitati ora fatturano una tariffa oraria per l'ambiente di runtime attivo stesso (il sandbox, il browser o il contesto di esecuzione in cui opera l'agente) separatamente dal costo del token delle chiamate al modello effettuate. Una tariffa rappresentativa per il 2026 è di circa 0,08 USD per ora di sessione di runtime attivo. Ciò si aggiunge al prezzo standard dei token di input/output, non lo sostituisce: una sessione dell'agente di lunga durata paga sia per il tempo in cui il suo ambiente rimane attivo sia per ogni token che il modello legge o scrive durante quel periodo.
In cosa differisce da un calcolatore dei costi agente per passaggio o per token?
I calcolatori degli agenti basati su passaggi e token determinano il prezzo delle chiamate del modello: quanti turni, quanti token input/output per turno. Questo calcolatore aggiunge la dimensione che manca: la tariffa oraria dell'ambiente di runtime, che si adatta alla durata della sessione, non a quanto il modello ha effettivamente fatto durante quel periodo. Un agente lento che impiega 20 minuti per completare un'attività paga 20 minuti di fatturazione per ora di sessione anche se ha effettuato pochissime chiamate modello in quella finestra; un agente veloce che termina in 2 minuti la stessa attività paga costi di runtime molto inferiori indipendentemente dal conteggio dei token. Entrambe le dimensioni contano e questo strumento le modella insieme.
Quali altri costi per utilizzo vengono in genere aggiunti dagli agenti gestiti?
Oltre al costo in ore di esecuzione e token, le piattaforme con agenti ospitati in genere misurano separatamente le chiamate ai singoli strumenti: una tariffa comune nel 2026 per uno strumento di ricerca web integrato è di circa $ 10 per 1.000 ricerche. Se l'attività dell'agente prevede la navigazione, la ricerca o la chiamata ad altri strumenti a consumo, tali costi per chiamata si sommano al costo di runtime e token nello stesso modo in cui una fattura cloud raggruppa elaborazione, archiviazione e uscita come voci separate.