Modello e utilizzo
—costo/query del token
—commissioni di ricerca/query
—totale/interrogazione
o4-mini vs o3: stesso carico di lavoro, entrambi i livelli
Il tuo token e il tuo profilo di ricerca hanno un prezzo su entrambi i livelli di ricerca approfondita. Le commissioni di ricerca sono identiche su entrambi: cambiano solo le tariffe dei token, quindi il divario aumenta man mano che i tuoi rapporti durano.
| Modello | Token/query | Cerca/interroga | Totale/interrogazione | Mensile |
|---|
Perché le query di ricerca approfondita costano dollari, non centesimi
I modelli di ricerca approfondita hanno il prezzo dei normali modelli sulla carta – dollari per milione di token – ma consumano token come nient’altro nel tuo stack. Una singola query esegue autonomamente un ciclo di ricerca: emette le proprie ricerche web, legge le pagine che trova nella finestra di contesto come token di input, ragiona a lungo su ciò che ha trovato (fatturato come token di output anche se non si vede mai la maggior parte del ragionamento) e infine scrive un lungo rapporto strutturato. Un compito realistico prevede circa 50.000 token di input, 20.000 token di output e 15 ricerche web: circa $ 0,41 su o4-mini-deep-research e $ 1,45 su o3-deep-research. Confrontalo con il tipico completamento di una chat che costa una frazione di un centesimo.
L'elemento pubblicitario che la maggior parte delle persone non vede è la tariffa di ricerca. I modelli di ricerca approfondita fatturano circa 10 dollari per 1.000 chiamate di ricerca web oltre ai token e le ricerche non possono essere disattivate: il prodotto è la ricerca autonoma. Quindici ricerche equivalgono a 0,15 dollari per query prima che venga conteggiato un singolo token, il che significa che le query brevi hanno un prezzo minimo rigido e le tabelle di confronto dei prezzi per token sottostimano sistematicamente quanto costa effettivamente la ricerca approfondita. Per query brevi le tariffe di ricerca possono superare completamente la fattura del token.
La leva pratica è il routing dei livelli. o4-mini-deep-research gestisce la ricerca di routine (scansioni competitive, riepiloghi strutturati, accertamento dei fatti) a circa 3,5 volte in meno per query rispetto a o3-deep-research. Indirizza tutto prima al livello mini e intensificalo solo dove la qualità del report è inferiore: con 100 query al mese quella singola decisione di instradamento fa la differenza tra circa $ 41 e $ 145, e si adatta linearmente da lì. Se hai solo bisogno di ricerche occasionali da una singola fonte anziché di cicli di ricerca completi, un modello normale con lo strumento di ricerca web è ancora più economico: modellalo separatamente con Calcolatore dei costi dello strumento di ricerca web LLM.
Costo dello strumento di ricerca Web LLMCosto del gettone ragionamentoCosto dell'agente per l'utilizzo del computerConfronta oltre 300 modelli IA
Come funziona questa calcolatrice
Questo calcolatore stima il costo totale per query e mensile di un carico di lavoro dell'API Deep Research su entrambi o3-ricerca-profonda O o4-mini-ricerca-profonda. Combina tre driver in un unico numero: il gettoni di input invii, al prezzo di input in dollari per milione; IL ragionamento e gettoni di output il modello genera mentre ricerca; e quello obbligatorio commissioni per la ricerca sul web addebitato per mille chiamate. Imposta il modello, il volume delle query mensili, il prezzo di input e la tariffa di ricerca e ridimensiona una singola query su un totale mensile in modo che i costi di ricerca e i costi dei token siano modellati insieme piuttosto che in isolamento.
Il compromesso principale è che le query di ricerca approfondita richiedono molte ricerche, quindi la tariffa di ricerca spesso rivaleggia o supera il costo simbolico. Poiché o3-deep-research ragiona e ricerca in modo più aggressivo rispetto a o4-mini-deep-research, il modello più economico può ridurre sia la spesa in token che quella per la ricerca su domande di routine. Orologio volume delle interrogazioni più da vicino, poiché le tariffe di ricerca si adattano linearmente e tendono a farlo dominare a conteggi mensili elevati.
Domande frequenti
Quanto costa una query API Deep Research?
Un compito di ricerca realistico (analisi competitiva, ricerca di mercato, sondaggio della letteratura) consuma in genere circa 50.000 token di input, 20.000 token di output (incluso il ragionamento nascosto) e circa 15 chiamate di ricerca web. Su o4-mini-deep-research ($ 2/milione di input, $ 8/milione di output) si avvicina a $ 0,41 per query: circa $ 0,10 in input, $ 0,16 in output e $ 0,15 in tariffe di ricerca web a $ 10 per 1.000 chiamate. Lo stesso compito su o3-deep-research (10 dollari/milione di input, 40 dollari/milione di output) costa circa 1,45 dollari, circa 3,5 volte di più. Le query brevi costano meno, ma le tariffe di ricerca mettono un limite a ogni query indipendentemente dalla lunghezza.
Perché non posso disattivare i costi di ricerca sul Web?
La ricerca sul Web è ciò che rende un modello di ricerca approfondita un modello di ricerca approfondita: l'API esegue le proprie ricerche come parte del ciclo di ricerca e tali chiamate fatturano circa $ 10 per 1.000 ricerche oltre ai costi dei token. A differenza dello strumento di ricerca web opzionale sui normali modelli di chat, i modelli di ricerca approfondita effettuano la ricerca in modo autonomo e le chiamate non possono essere disabilitate. Nelle query brevi le tariffe di ricerca possono rappresentare la singola voce di riga più grande: 15 ricerche equivalgono a $ 0,15 prima che venga fatturato un singolo token, motivo per cui i soli confronti dei prezzi per token sottostimano i costi di ricerca profondi.
Dovrei usare o3-deep-research o o4-mini-deep-research?
o4-mini-deep-research costa circa 3-4 volte meno per query ($2/$8 per milione di token contro $10/$40) e gestisce la maggior parte delle attività di ricerca di routine: riepiloghi, scansioni competitive, ricerca di fatti strutturata. o3-deep-research è il livello di punta per un lavoro di sintesi veramente impegnativo in cui la profondità dell'analisi giustifica il pagamento di diversi dollari per query. Un modello di produzione comune instrada tutto prima a o4-mini e intensifica solo le query in cui il report più economico si rivela insufficiente: con carichi di lavoro tipici la decisione di instradamento modifica la fattura mensile di 3,5 volte.