24 luglio 2026 · AI e LLM · 5 minuti di lettura
Ecco la parte che manca alla maggior parte delle persone: sull'API, GPT-5 è più economico di GPT-4o. L'ammiraglia GPT-5 elenca a $ 1,25 per 1 milione di token di input e $ 10 per 1 milione di output - esattamente la metà del prezzo di input di GPT-4o ($ 2,50) allo stesso prezzo di output ($ 10), con una finestra di contesto di 400.000 invece di 128.000. Più nuovo ed economico non è la direzione abituale, quindi vale la pena fare i conti.
Per 1 milione di token, dall'attuale gamma OpenAI:
| Modello | Ingresso /1M | Uscita/1M | Contesto |
|---|---|---|---|
| GPT-5.5 (ammiraglia principale) | $5.00 | $30.00 | 400K |
| GPT-5 (ammiraglia) | $1.25 | $10.00 | 400K |
| GPT-5mini | $0.40 | $1.60 | 400K |
| GPT-5nano | $0.10 | $0.40 | 400K |
| GPT-4o (per riferimento) | $2.50 | $10.00 | 128K |
| GPT-4o mini (riferimento) | $0.15 | $0.60 | 128K |
Effettua una chiamata tipica: 1.000 token di input + 500 token di output (un breve suggerimento con contesto, una risposta media). Il costo è (token in input ÷ 1M × prezzo in input) + (token in output ÷ 1M × prezzo in output):
| Modello | Costo/chiamata | A 1 milione di chiamate al mese |
|---|---|---|
| GPT-5.5 | $0.0200 | $20,000 |
| GPT-4o | $0.0075 | $7,500 |
| GPT-5 | $0.00625 | $6,250 |
| GPT-5mini | $0.0012 | $1,200 |
| GPT-5nano | $0.0003 | $300 |
Quindi si tratta di sostituire GPT-4o con GPT-5 sullo stesso carico di lavoro 17% più economico - e ottieni 3 volte il contesto gratuitamente. Passa a GPT-5 mini e gli stessi costi di lavoro 84% in meno rispetto a GPT-4o. GPT-5 nano arriva a $ 300 al mese per un milione di chiamate.
Si noti che i token di output dominano ogni riga. Sul modello di punta, il prezzo dell’output è 8 volte quello dell’input ($ 10 contro $ 1,25). Ciò significa che il modo più economico per ridurre la bolletta GPT-5 non è cambiare modello: lo è chiedendo risposte più brevi. Un modello dettagliato che scrive 1.500 token di output dove ne basterebbero 300 sta tranquillamente triplicando la costosa metà della bolletta. E GPT-5.5, il livello premium a $ 5/$ 30, costa 3,2 volte il costo del semplice GPT-5 per chiamata: ne vale la pena solo per le attività che ne hanno veramente bisogno.
Per la maggior parte del traffico di produzione la risposta onesta è GPT-5 mini o nano, escalating to GPT-5 only when quality demands it — the classic routing pattern. Reserve GPT-5.5 for the hardest reasoning. Run your own numbers with your real token counts before committing:
Nuovo ai prezzi dei token? Inizia con il guide gratuite sui costi API.
I prezzi sono prezzi di listino OpenAI tracciati nel nostro catalogo modelli (luglio 2026) e sono stime di riferimento: conferma le tariffe attuali sulla pagina dei prezzi di OpenAI prima di definire il budget. Le cifre per chiamata vengono calcolate in base ai prezzi di listino per una chiamata token da 1.000 input/500 output.