capace più economico
più economico/mese
diffusione di punta / mese

Tabella dei prezzi completi: il tuo carico di lavoro

Token di riferimento da $/1 milione (luglio 2026), costo mensile sui numeri sopra indicati.

FornitoreModelloIn $/1 milioneFuori $/1 milioneCosto/mese

Più economico in base al caso d'uso

⚠️ Prezzi di riferimento, luglio 2026: tutti e tre i fornitori modificano regolarmente i prezzi. Conferma sulla pagina dei prezzi di ciascun fornitore. L'output viene fatturato separatamente e costa più dell'input su ogni modello. · Segnala prezzo obsoleto →
✓ Ultima verifica: 15-08-2026· Fonte: pagina ufficiale dei prezzi del fornitore· Monitoraggio automatico — segnalare il cambiamento →

Come scegliere concretamente

La fedeltà alla marca è l’abitudine più costosa nell’intelligenza artificiale. I tre fornitori si scavalcano costantemente e la differenza di costo reale deriva da due cose che controlli: il livello del modello scegli tu e come a lungo le tue uscite Sono. Un modello di frontiera con risposte brevi può essere più economico di un modello "economico" con risposte sconclusionate. Dai un prezzo al carico di lavoro, non al logo: la tabella sopra fa esattamente questo sui tuoi numeri.

Esamina un fornitore con il Calcolatrice GPT-4o, IL Calcolatrice Claude o il Calcolatrice dei Gemelli, confronta tutti i modelli contemporaneamente su calcolatore completo dei costi dell'API AIo stimare un intero prodotto con il Stima dei costi delle app AI.

Tre leve riducono ulteriormente il conto una volta scelto un modello e tutti e tre i fornitori li offrono tutti e tre. Memorizzazione nella cache immediata rivaluta le richieste e i documenti di sistema ripetuti a una frazione della normale velocità di input: ne vale la pena per qualsiasi app che invia nuovamente le stesse istruzioni o contesto a ogni chiamata; dimensionalo su calcolatore rapido del risparmio di memorizzazione nella cache. UN API batch offre uno sconto di circa il 50% per lavori che possono attendere alcune ore invece di richiedere una risposta in tempo reale; vedere il calcolatore del risparmio API batch. E per le app a volume elevato, instradamento richieste di routine a un modello più economico, riservando l'ammiraglia alle custodie rigide è spesso la leva più grande di tutte: modellalo sul Calcolatore dei costi del router modello AI.

Un'altra differenza che non appare nella tabella dei prezzi: solo Gemelli ha un vero livello API gratuito (Google AI Studio, nessuna carta richiesta), che lo rende il modo più economico per creare prototipi prima di impegnare la spesa. OpenAI e Anthropic richiedono entrambi la configurazione della fatturazione sin dalla prima richiesta, sebbene i nuovi account ricevano un credito di prova limitato.

Domande frequenti

Qual è il più economico: OpenAI, Claude o Gemini? Per il modello più economico, Gemini 2.0 Flash ($ 0,10 / $ 0,40 per 1 milione di token) e GPT-4o mini ($ 0,15 / $ 0,60) sono in testa. Tra i flagship, Gemini 2.5 Pro ha il prezzo di input più basso, GPT-4o si trova nel mezzo e Claude Opus è il più costoso: il vincitore dipende dal livello di cui hai bisogno, non dal marchio.

Claude è più costoso di GPT-4o? Claude Sonnet 4 ($ 3 / $ 15) è un po 'più costoso di GPT-4o ($ 2,50 / $ 10) e Claude Opus 4 è molto più costoso, ma Claude Haiku 3.5 è inferiore a GPT-4o. Confronta il carico di lavoro effettivamente eseguito, poiché la lunghezza dell'output domina il conto.

Tutti e tre supportano la memorizzazione nella cache immediata e gli sconti batch? Sì, tutti e tre offrono la memorizzazione nella cache per richieste ripetute e un'API batch a circa la metà del prezzo. Il risparmio reale dipende da quanto sono ripetitivi i tuoi prompt e se il tuo lavoro può tollerare il ritardo del batch.

Qualcuno dei tre ha un livello API gratuito? Gemini è l'unico: Google AI Studio offre accesso gratuito con limiti di velocità sufficientemente generosi per la prototipazione. OpenAI e Anthropic richiedono prima la configurazione della fatturazione, sebbene entrambi concedano un credito di prova limitato ai nuovi account.