La trappola con gli agenti: un'attività che assomiglia a una domanda è in realtà 5-20 chiamate LLM. Un chatbot risponde una volta. Un agente ragiona, chiama strumenti e rilegge il proprio contesto in crescita ad ogni passaggio, quindi lo stesso modello che costa una frazione di centesimo per messaggio di chat può costare 10-50 volte quello per attività dell'agente. Questa calcolatrice lo moltiplica correttamente.

al mese
per attività
all'anno
Chiamate LLM / mese

Modelli più economici per questo agente

Stesso carico di lavoro, ogni modello classificato in base al costo mensile.

ModelloCosto/mesePer attività
⚠️ Stima utilizzando prezzi di riferimento (luglio 2026) e tariffe di listino. Il costo reale dell'agente dipende in larga misura dalla quantità di contesto inviato nuovamente per ogni passaggio: gli agenti che alimentano nuovamente la cronologia completa aumentano i token di input a ogni ciclo. Digita il numero reale di token per passo per ottenere la cifra più vicina. · Segnala prezzo obsoleto →

Come si somma effettivamente il costo dell'agente

La formula è attività × passaggi × (gettoni di input × prezzo di input + token di output × prezzo di output). Il moltiplicatore che le persone dimenticano è questo passi: un agente di ricerca potrebbe richiedere 12 cicli, un agente di codifica 20+. E poiché la maggior parte degli agenti invia nuovamente la conversazione accumulata a ogni passaggio, inserire gettoni per ogni gradino salito man mano che l'attività procede — il numero inserito sopra è la media dell'intero ciclo. L'output è solitamente piccolo per passo (un breve pensiero o una chiamata a uno strumento), ecco perché l'input domina la fattura dell'agente - e perché la memorizzazione nella cache e il taglio del contesto sono importanti più qui che altrove.

Come tagliarlo

Quattro leve, in ordine di impatto: (1) instradamento del modello — utilizzare un modello piccolo per le fasi di routine e un modello di frontiera solo per quelle difficili; (2) gradino — fermare i circuiti fuori controllo; (3) rifinitura del contesto — non inviare nuovamente l'intera cronologia a ogni passaggio; (4) memorizzazione nella cache tempestiva per il prompt del sistema statico e le definizioni degli strumenti. Vedi il guida rapida alla memorizzazione nella cache e il calcolatore del risparmio di memorizzazione nella cache. Costruire un chatbot invece di un agente? Usa il calcolatore dei costi del chatbot. Tutta l'app? IL Stima dei costi delle app AI. Esecuzione di più di un agente sullo stesso compito: modelli di distribuzione, dibattito, supervisore o sciame? Questo calcolatore valuta un singolo agente; utilizzare il Calcolatore del costo dello sciame di agenti AI per vedere il moltiplicatore che questi modelli di orchestrazione aggiungono in cima.

Ospita il tuo progetto:DigitalOcean: $ 200 gratis ↗Hostinger VPS
Calcolatore dei costi di valutazione LLMCalcolatore dei costi di generazione dei dati sinteticiLicenza AI Seat e calcolatore dei costi APICalcolatore dei tempi e dei costi di elaborazione batchCalcolatore del costo AI per utente