Pubblicato il 12-06-2026 · prezzi di riferimento, verificare prima di definire il budget
"Quale API AI è la più economica?" non ha risposta finché non risolvi un carico di lavoro. Così abbiamo fatto. Stesso lavoro su tutti i modelli principali: 1.000.000 di richieste, ciascuno con 1.000 gettoni di input E 500 gettoni di uscita (un tipico breve chatbot o chiamata di generazione). Si tratta di 1 miliardo di token di input e 500 milioni di token di output. Ecco cosa addebita ciascun fornitore.
| Modello | In $/1 milione | Fuori $/1 milione | Costo per 1 milione di richieste |
|---|---|---|---|
| Gemelli 2.0 Flash più economico | $0.10 | $0.40 | $300 |
| GPT-4omini | $0.15 | $0.60 | $450 |
| DeepSeek-V3 | $0.27 | $1.10 | $820 |
| Gemelli 2.5Flash | $0.30 | $2.50 | $1,550 |
| Claude Haiku 3.5 | $0.80 | $4.00 | $2,800 |
| GPT-4o | $2.50 | $10.00 | $7,500 |
| Claude Sonetto 4 | $3.00 | $15.00 | $10,500 |
I prezzi sono stime di riferimento, luglio 2026. Segnala prezzo obsoleto →
Stesso carico di lavoro. $ 300 su Gemini 2.0 Flash, $ 10.500 su Claude Sonnet 4 - UN diffusione 35× per lo stesso identico numero di richieste. Il modello che scegli è, con un ampio margine, la leva più importante sulla tua bolletta dell’IA.
Il problema che ogni confronto onesto deve aggiungere: un modello più economico che necessita di due tentativi o che scrive risposte più lunghe può costare più di uno più costoso che riesce a inchiodarlo la prima volta. La qualità conta. Lo schema intelligente su cui atterra la maggior parte delle squadre è suddivisione in livelli: un modello economico (Gemini Flash, GPT-4o mini, DeepSeek) per chiamate di routine ad alto volume, e un modello di frontiera (GPT-4o, Claude Sonnet) solo per le richieste più difficili. Anche inviare il 20% del traffico a un modello di frontiera ti mantiene vicino alla fascia più economica di questa tabella.
Dopo la scelta del modello, due cose muovono l’ago: lunghezza di uscita (l'output viene fatturato 4–5 volte l'input su ogni fornitore qui - limitalo) e memorizzazione nella cache tempestiva (contesto ripetuto fatturato con un forte sconto su OpenAI, Anthropic e DeepSeek). Taglia il prompt del sistema, cap max_tokense memorizza nella cache ciò che si ripete.
I tuoi gettoni non sono nostri. Collega le lunghezze e il volume di input/output reali al file Calcolatore dei costi dell'API AI - classifica ogni modello per tuo numeri. Costruire qualcosa di specifico? Usa il Stima dei costi delle app AI, IL calcolatore dei costi del chatbot o il Calcolatore dei costi RAG. Approfondimenti per modello: GPT-4o, Claudio, Gemelli, DeepSeek.
Apri il calcolatore dei costi API AI → · OpenAI contro Claude contro Gemini →
Prezzi di riferimento (giugno 2026). Verifica sulla pagina dei prezzi di ciascun fornitore prima di definire il budget. Non affiliato con nessun fornitore.