Perguntas frequentes
Os modelos de raciocínio cobram por tokens de pensamento?
Sim. Modelos como o3 e Gemini Thinking geram tokens de raciocínio ocultos antes da resposta visível, e são cobrados de acordo com a taxa de saída. Muitas vezes, eles superam o resultado visível, portanto o custo real é muito maior do que o comprimento da resposta sugere.
Como posso controlar o custo de raciocínio?
Use uma configuração de esforço de raciocínio quando disponível, mude para um modelo padrão para tarefas simples e meça o uso real do token de raciocínio – ele varia muito de acordo com o prompt.