Fornitore
Categoria

0 modelli confrontati · fare clic sull'intestazione di una colonna per ordinare

Modello ▲▼ Fornitore ▲▼ Ingresso $/1M ▲▼ Produzione $/1M ▲▼ Miscelato 3:1 ▲▼ Contesto ▲▼ Tuo $/mese ▲▼
🔔 I prezzi variano di ~10×/anno. Una sola email quando cambia il prezzo di un modello, nient'altro.
⚠️ I prezzi sono cifre di riferimento approssimative, ultimo aggiornamento 2026-07e cambiano frequentemente: €/£ indicato a un tasso FX fisso approssimativo per un rapido confronto; conferma sempre sulla pagina dei prezzi del fornitore prima di impegnarti. I token di output costano più dell'input su quasi tutti i provider. I modelli open-weight ospitati (Llama, Qwen, DeepSeek, Mixtral) variano in base all'host. Prezzo più economico ≠ migliore qualità; valutare i costi rispetto all'accuratezza del tuo compito. · Segnala prezzo obsoleto →

Perché un confronto equo dei prezzi dell'IA ha bisogno di due numeri

Quasi tutte le tabelle dei "prezzi dei modelli AI" che troverai online vengono ordinate in base al prezzo di input, perché è il numero più piccolo e più semplice da stampare. Ma le applicazioni reali vengono fatturate Entrambi direzioni e i token di output hanno normalmente un prezzo da due a sei volte superiore a quello di input. Un'app di recupero o riepilogo che legge documenti lunghi e scrive risposte brevi richiede molti input; un chatbot, un agente o un generatore di codice che produce lunghi completamenti è pesante in termini di output. Gli stessi due modelli possono scambiarsi di posizione nella classifica esclusivamente in base alla direzione in cui si inclina il traffico. Ecco perché questa tabella mostra input e output separatamente, aggiunge a linea di base miscelata 3:1 (un rapporto comune nel mondo reale di tre token di input per token di output) per un rapido smistamento da mela a mela e ti consente di inserire i tuoi volumi per calcolare la fattura che pagheresti effettivamente.

Come leggere la tabella

Digita nella casella di ricerca per passare a un modello o fornitore oppure fai clic sul fornitore e sulla categoria per restringere il campo: ammiraglia, medio, budget, ragionamento, incorporamento, visione o peso aperto. Fare clic su qualsiasi intestazione di colonna per ordinare in modo crescente, fare nuovamente clic per invertire. IL I tuoi $/mese La colonna viene ricalcolata istantaneamente dai volumi di input e output nella parte superiore, in modo da poter dimensionare un carico di lavoro reale rispetto a ciascun modello contemporaneamente. Il contesto viene mostrato in migliaia di token (K): una finestra di contesto da 1000K significa un milione di token.

La qualità di frontiera sta diventando economica

Il divario tra i modelli premium e quelli budget si è ridotto drasticamente. Nel 2026 è possibile eseguire un modello open-weight di prima classe – Llama 4, Qwen 3, DeepSeek V4 – per una frazione di quanto costano GPT-5.5 o Claude Opus e per molte attività di produzione (classificazione, estrazione, chat di routine) la differenza di qualità è invisibile agli utenti finali. I rivenditori ospitati come Together, Fireworks, DeepInfra, Groq e Novita competono sugli stessi pesi, quindi lo stesso modello può apparire più volte a prezzi leggermente diversi. La mossa giusta raramente è "utilizzare il modello migliore ovunque": è così percorso per difficoltà, lasciando che un modello economico gestisca la maggior parte delle chiamate mentre un modello di frontiera è riservato alla dura minoranza delle chiamate.

Tre leve sotto il prezzo del modello

Una volta scelto un modello, tre meccanismi riducono ulteriormente il conto. Memorizzazione nella cache immediata fattura i prompt e il contesto del sistema ripetuti a una frazione della normale velocità di input: ridimensionalo sul calcolatore rapido del risparmio di memorizzazione nella cache. API batch offri uno sconto di circa il 50% per i lavori che possono aspettare: vedi il calcolatore del risparmio API batch. E instradare le chiamate di routine a un modello più piccolo è spesso la leva più importante di tutte: modellalo sul modello Calcolatore dei costi del router modello AI.

Strumenti e guide correlati

Strumento di ricerca API LLM più economico · Calcolatore del costo del token LLM · Prezzi OpenAI vs Claude vs Gemini · Calcolatore dei prezzi LLM misti · Calcolatore dei costi del router modello AI · Tutte le API AI

Calcolatore da parole a tokenCalcolatore dei costi dell'API VisionCalcolatore dei costi Self-Host e APICalcolatore dei costi di inferenza GPUCalcolatore del risparmio sulla riduzione dei prezzi LLM