HomeBlog › Deflazione dei prezzi LLM e budget

Il tuo budget per l'intelligenza artificiale è probabilmente sbagliato: i prezzi dei LLM scendono di circa 10 volte all'anno

Pubblicato il 11-07-2026 · basato sul nostro nuovo Tracker della cronologia dei prezzi LLM - tutti i principali eventi sui prezzi dal GPT-4, con le date

Abbiamo raccolto tutte le principali variazioni di prezzo dell'API LLM da marzo 2023 a oggi in una sola sequenza temporale. Il modello è più coerente di quanto ci aspettassimo e interrompe la maggior parte dei fogli di calcolo del budget AI che abbiamo visto: a capacità costante, i prezzi scendono di circa 10 volte all’anno. Non gradualmente, ma per gradi e di solito secondo direzioni che nessuno aveva previsto.

Tre numeri che raccontano la storia

DataInput di classe frontiera, $/1 milionerispetto al lancio di GPT-4
marzo 2023 (GPT-4)$30.00
Agosto 2024 (GPT-4o dopo il taglio)$2.50−92%
2026 (ospiti a peso aperto)<$ 1,00−97%

Prezzi di listino storici. Cronologia completa con 14 eventi datati sul pagina della cronologia dei prezzi.

Il meccanismo è importante: i singoli modelli raramente diventano più economici (i due tagli di GPT-4o erano un'eccezione). Ciò che realmente accade è sostituzione — ogni nuova generazione viene spedita al livello inferiore della generazione precedente. GPT-4o mini batte GPT-3.5 Turbo a un terzo del suo prezzo. DeepSeek V2 offriva una qualità quasi frontiera a $ 0,14. Non si cavalca la deflazione aspettando gli sconti; lo puoi cavalcare riacquistando il livello.

Ciò che questo rompe

Contratti annuali alle tariffe odierne. Uno sconto sul volume del 30% bloccato per 12 mesi è una perdita se i prezzi di mercato scendono del 60-90% in quel periodo – e storicamente è così. Qualunque cosa più lunga di un impegno di 6-12 mesi è una scommessa contro una tendenza triennale. Se devi impegnarti, impegnati a spendere, non al tariffario di un modello specifico.

Decisioni "L'intelligenza artificiale è troppo costosa per questa funzionalità". Una funzionalità che oggi costa $ 10.000 al mese costa probabilmente $ 1-3.000 a parità di qualità entro 18 mesi. L'economia unitaria marginale ora di solito significa presto una buona economia unitaria: il calcolo build-vs-wait dovrebbe includere la curva, non solo l'adesivo di oggi.

Profonda integrazione con un unico fornitore. Entrambi gli shock di prezzo discontinui nella nostra sequenza temporale (maggio 2024, gennaio 2025) provenivano da DeepSeek, un outsider. I team con routing indipendente dal fornitore hanno catturato tali prezzi in pochi giorni; le squadre saldate a un SDK guardavano da bordo campo. Il costo di ingegneria di uno strato di astrazione è un premio assicurativo sullo shock successivo.

Ciò che la tendenza NON dice

Due onesti avvertimenti dai dati. Primo, i prezzi alla produzione scendono più lentamente — GPT-4 lanciato con uscita a 2× ingresso; oggi i rapporti 4–5× sono standard. I carichi di lavoro pesanti (generazione di codice, risposte lunghe) si sgonfiano in modo significativamente più lento del titolo. Secondo, i prezzi aumentano: Claude 3.5 Haiku è stato lanciato a 3,2 volte il prezzo del suo predecessore perché era considerato un modello di fascia media. Il livello economico che rimane economico è un'abitudine, non una garanzia: non codificarlo mai.

La routine pratica

Trimestrale, quindici minuti: metti il ​​tuo vero mix di token nel Confronto di oltre 300 modelli e controlla se il tuo modello attuale vince ancora il suo livello. Quando ciò non avviene, il calcolatore del risparmio in termini di riduzione dei prezzi prezzi la migrazione. La maggior parte dei team che modelliamo riscontrano un risparmio del 30-60% la prima volta che lo fanno: soldi che erano sul tavolo semplicemente perché la scelta del modello è stata fatta due trimestri fa.

Tutte le cifre sono prezzi di listino storici, compilati nel luglio 2026: dettagli e fonti sul pagina della cronologia dei prezzi. Imparentato: Confronto dei prezzi dei modelli AI · Risparmi relativi al routing del modello · API LLM più economica.