✓ Ultima verifica: 15-07-2026· Fonte: pagina ufficiale dei prezzi del fornitore· Monitoraggio automatico — segnalare il cambiamento →
Un agente non risponde in una sola chiamata: si ripete: pensa, chiama uno strumento, leggi il risultato, ripensaci. Ogni ciclo è una richiesta fatturata, quindi il costo viene moltiplicato per il numero di passaggi. Inserisci il tuo utilizzo per vedere la fattura mensile reale e il modello più economico per il lavoro.
La trappola con gli agenti: un'attività che assomiglia a una domanda è in realtà 5-20 chiamate LLM. Un chatbot risponde una volta. Un agente ragiona, chiama strumenti e rilegge il proprio contesto in crescita ad ogni passaggio, quindi lo stesso modello che costa una frazione di centesimo per messaggio di chat può costare 10-50 volte quello per attività dell'agente. Questa calcolatrice lo moltiplica correttamente.
—
al mese
—per attività
—all'anno
—Chiamate LLM / mese
Modelli più economici per questo agente
Stesso carico di lavoro, ogni modello classificato in base al costo mensile.
Modello
Costo/mese
Per attività
⚠️ Stima utilizzando prezzi di riferimento (luglio 2026) e tariffe di listino. Il costo reale dell'agente dipende in larga misura dalla quantità di contesto inviato nuovamente per ogni passaggio: gli agenti che alimentano nuovamente la cronologia completa aumentano i token di input a ogni ciclo. Digita il numero reale di token per passo per ottenere la cifra più vicina. · Segnala prezzo obsoleto →
Come si somma effettivamente il costo dell'agente
La formula è attività × passaggi × (gettoni di input × prezzo di input + token di output × prezzo di output). Il moltiplicatore che le persone dimenticano è questo passi: un agente di ricerca potrebbe richiedere 12 cicli, un agente di codifica 20+. E poiché la maggior parte degli agenti invia nuovamente la conversazione accumulata a ogni passaggio, inserire gettoni per ogni gradino salito man mano che l'attività procede — il numero inserito sopra è la media dell'intero ciclo. L'output è solitamente piccolo per passo (un breve pensiero o una chiamata a uno strumento), ecco perché l'input domina la fattura dell'agente - e perché la memorizzazione nella cache e il taglio del contesto sono importanti più qui che altrove.
Come tagliarlo
Quattro leve, in ordine di impatto: (1) instradamento del modello — utilizzare un modello piccolo per le fasi di routine e un modello di frontiera solo per quelle difficili; (2) gradino — fermare i circuiti fuori controllo; (3) rifinitura del contesto — non inviare nuovamente l'intera cronologia a ogni passaggio; (4) memorizzazione nella cache tempestiva per il prompt del sistema statico e le definizioni degli strumenti. Vedi il guida rapida alla memorizzazione nella cache e il calcolatore del risparmio di memorizzazione nella cache. Costruire un chatbot invece di un agente? Usa il calcolatore dei costi del chatbot. Tutta l'app? IL Stima dei costi delle app AI. Esecuzione di più di un agente sullo stesso compito: modelli di distribuzione, dibattito, supervisore o sciame? Questo calcolatore valuta un singolo agente; utilizzare il Calcolatore del costo dello sciame di agenti AI per vedere il moltiplicatore che questi modelli di orchestrazione aggiungono in cima.
IL Calcolatore dei costi dell'agente AI stima la spesa mensile LLM per la gestione di un agente AI. Perché un agente completa ciascuna attività attraverso diverse Passaggi LLM — turni di ragionamento più chiamate allo strumento — il costo di un'attività è il costo del token per passaggio moltiplicato per ogni passaggio, quindi moltiplicato nuovamente per il volume dell'attività mensile. I driver principali sono tuoi compiti al mese, il numero di Passaggi LLM per attività, IL token di input e output medi per passaggio, IL modello scegli (che imposta il prezzo per token) e qualsiasi altro ottimizzazione come la memorizzazione nella cache o modelli più economici. Piccoli numeri per passaggio si sommano rapidamente tra passaggi e attività.
Il compromesso chiave da tenere d’occhio è conteggio dei passi rispetto alla qualità del modello. Un modello più economico potrebbe richiedere più passaggi di ragionamento o tentativi per completare un'attività, quindi un prezzo per token inferiore non sempre significa un totale inferiore. Stima il costo dell'intera attività, non di una singola chiamata, e verifica che i conteggi dei token immessi riflettano le richieste reali: le lunghe istruzioni di sistema e gli output dello strumento vengono conteggiati come input in ogni passaggio.
Domande frequenti
Perché un agente AI costa più di una singola chiamata chatbot?
Un agente risolve un'attività su molte chiamate LLM: ragiona, chiama uno strumento, legge il risultato, ragiona di nuovo e ripete. Ogni passaggio corrisponde a una richiesta fatturata completamente e il contesto in esecuzione di solito aumenta a ogni passaggio, quindi una singola attività può costare 5-20 volte la risposta one-shot di un chatbot.
Come posso ridurre i costi degli agenti AI?
Utilizza un modello più economico per i passaggi di routine e riserva un modello di frontiera per quelli complessi, limita il numero di passaggi per attività, ritaglia il contesto che invii nuovamente per ogni passaggio e attiva la memorizzazione nella cache dei prompt del sistema statico e delle definizioni degli strumenti che si ripetono ad ogni chiamata.