Pubblicato il 30-06-2026 · prezzi di riferimento, verificare prima del budget
La guerra dei prezzi LLM del 2026 ha una nuova forma: Grok degli xAI si è inserito nella conversazione come leader dei costi, OpenAI e Google si sono divisi in budget chiari e livelli premium, e Claude di Anthropic è ancora in cima alla scala dei prezzi. Per rendere il confronto onesto, abbiamo fatto quello che facciamo sempre: abbiamo fissato un carico di lavoro e gli abbiamo fissato un prezzo per tutti i modelli principali. Il lavoro: 1.000.000 di richieste, each 1,000 input tokens and 500 output tokens (a typical short chat or generation call). That's 1 billion input tokens and 500 million output tokens.
| Modello | In $/1 milione | Fuori $/1 milione | Cost for 1M requests |
|---|---|---|---|
| Grok 4.1 Veloce frontiera più economica | $0.20 | $0.50 | $450 |
| DeepSeek V3 | $0.27 | $1.10 | $820 |
| GPT-5.4 mini | $0.40 | $1.60 | $1,200 |
| Gemelli 2.5Flash | $0.30 | $2.50 | $1,550 |
| Gemelli 3.1 Pro | $2.00 | $12.00 | $8,000 |
| GPT-5.4 | $2.50 | $15.00 | $10,000 |
| Grok 4 (ammiraglia) | $3.00 | $15.00 | $10,500 |
| Claude Opus 4.6 | $5.00 | $25.00 | $17,500 |
I prezzi sono stime di riferimento, luglio 2026. Segnala prezzo obsoleto →
Stesso carico di lavoro, $ 450 su Grok 4.1 Fast contro $ 17.500 su Claude Opus 4.6 - UN ~39× diffusione. The single biggest decision on your AI bill is still which model you route to, and in 2026 the cheap end of the frontier moved to xAI.
Grok è diventato aggressivo sul prezzo. xAI's Fast tier at $0.20/$0.50 undercuts even DeepSeek on output and sits well below every Western frontier model — a deliberate land-grab, bundled with a huge context window and live X data. OpenAI and Google bifurcated. Each now has a genuinely cheap small model (GPT-5.4 mini, Gemini 2.5 Flash) and a pricey flagship (GPT-5.4, Gemini 3.1 Pro), so "which is cheaper, OpenAI or Google?" depends entirely on which tier you mean. Claude stayed premium. Opus rimane il token più costoso tra le major: Anthropic valuta la capacità e l'affidabilità, non la leadership in termini di costi. Se il tuo budget è il limite, Claude Haiku (molto più economico) è il livello da guardare, non Opus.
Il numero che vince questa tabella non vince automaticamente il tuo progetto. Un modello più economico che necessita di un nuovo tentativo, scrive risposte più lunghe o fallisce su richieste difficili può costare di più in pratica rispetto a uno più costoso che funziona al primo tentativo. Anche la lunghezza dell'output è importante: l'output viene fatturato 2,5–5 volte l'input in ogni modello qui, quindi un modello economico e dettagliato può perdere rispetto a uno costoso e conciso. Lo schema su cui si basa la maggior parte delle squadre è tiering: route routine, high-volume traffic to a cheap model (Grok Fast, Gemini Flash, DeepSeek) and escalate only the genuinely hard requests to a flagship. Even sending 20% of calls to a premium model keeps your blended cost near the cheap end of the table.
Una volta scelto il modello, tre cose muovono il conto: output caps (set max_tokens — la produzione rappresenta la metà costosa), memorizzazione nella cache tempestiva (repeated system prompts are billed at a steep discount on OpenAI, Anthropic, Grok and DeepSeek), and instradamento (cheap-first, escalate on uncertainty). Each compounds with the others. Model the savings with the calcolatore di memorizzazione nella cache rapida e il calcolatore di routing del modello.
Your tokens aren't ours, so the ranking can flip on output-heavy or input-heavy traffic. Plug your real input/output lengths and volume into the ranking API LLM più economico — it sorts every model for tuo numeri - o il Calcolatore dei costi dell'API AI. Building something specific? Use the Stima dei costi delle app AI, and if you resell AI in a subscription, the Calcolatore dei prezzi del wrapper AI mostra se il tuo prezzo cancella effettivamente il costo dell'API. Guide per fornitore: Grok, OpenAI, Claudio, Gemelli, DeepSeek.
Apri la classifica API LLM più economica → · OpenAI contro Claude contro Gemini →
Prezzi di riferimento (giugno 2026), raccolti dalle pagine dei prezzi pubblici e dai confronti dei fornitori; i nomi dei modelli e le tariffe cambiano spesso: verifica prima di stabilire il budget. Non affiliato con nessun fornitore.