Domande frequenti
I modelli di ragionamento fanno pagare i gettoni pensanti?
SÌ. Modelli come o3 e Gemini Thinking generano token di ragionamento nascosti prima della risposta visibile e questi vengono fatturati alla tariffa di output. Spesso superano il risultato visibile, quindi il costo reale è molto più elevato di quanto suggerisca la lunghezza della risposta.
Come posso controllare il costo del ragionamento?
Utilizza un'impostazione relativa allo sforzo di ragionamento, ove disponibile, passa a un modello standard per attività semplici e misura l'utilizzo effettivo dei token di ragionamento: varia notevolmente in base al prompt.