Modelo e uso
—custo/consulta do token
—taxas de pesquisa/consulta
—total / consulta
o4-mini vs o3 — mesma carga de trabalho, ambas as camadas
Seu token e perfil de pesquisa com preços em ambos os níveis de pesquisa profunda. As taxas de pesquisa são idênticas em ambos – apenas as taxas de token mudam, então a diferença aumenta à medida que seus relatórios ficam mais longos.
| Modelo | Tokens/consulta | Pesquisa / consulta | Total/consulta | Mensal |
|---|
Por que consultas de pesquisa profunda custam dólares, não centavos
Os modelos de pesquisa profunda têm preços semelhantes aos dos modelos comuns no papel – dólares por milhão de tokens – mas consomem tokens como nenhum outro em sua pilha. Uma única consulta executa autonomamente um ciclo de pesquisa: ela emite suas próprias pesquisas na web, lê as páginas que encontra na janela de contexto como tokens de entrada, raciocina detalhadamente sobre o que encontrou (faturado como tokens de saída, mesmo que você nunca veja a maior parte do raciocínio) e, finalmente, escreve um longo relatório estruturado. Uma tarefa realista atinge cerca de 50 mil tokens de entrada, 20 mil tokens de saída e 15 pesquisas na web – cerca de US$ 0,41 em o4-mini-deep-research e US$ 1,45 em o3-deep-research. Compare isso com a conclusão típica de um bate-papo que custa uma fração de centavo.
O item de linha que a maioria das pessoas sente falta é a taxa de pesquisa. Os modelos de pesquisa profunda cobram cerca de US$ 10 por 1.000 chamadas de pesquisa na web além dos tokens, e as pesquisas não podem ser desativadas – a pesquisa autônoma é o produto. Quinze pesquisas custam US$ 0,15 por consulta antes que um único token seja contado, o que significa que consultas curtas têm um preço mínimo rígido e tabelas de comparação de preços por token subestimam sistematicamente o custo real da pesquisa profunda. Em consultas breves, as taxas de pesquisa podem exceder totalmente a conta do token.
A alavanca prática é o roteamento em camadas. o4-mini-deep-research lida com pesquisas de rotina – varreduras competitivas, resumos estruturados, apuração de fatos – cerca de 3,5 vezes menos por consulta do que o3-deep-research. Encaminhe tudo primeiro para o mininível e escale apenas onde a qualidade do relatório for insuficiente: com 100 consultas por mês, essa única decisão de roteamento representa a diferença entre aproximadamente US$ 41 e US$ 145, e é dimensionada linearmente a partir daí. Se você precisar apenas de pesquisas ocasionais de fonte única, em vez de ciclos completos de pesquisa, um modelo regular com a ferramenta de pesquisa na web é ainda mais barato - modelo que separadamente com o Calculadora de custos da ferramenta de pesquisa na web LLM.
Custo da ferramenta de pesquisa na web LLMCusto do token de raciocínioCusto do Agente de Uso de ComputadorCompare mais de 300 modelos de IA
Como funciona esta calculadora
Calculadora de custo gratuita da API Deep Research – custo total por consulta para o3-deep-research e o4-mini-deep-research: tokens de entrada + raciocínio de saída mais as taxas obrigatórias de pesquisa na web de US$ 10/1k, modeladas em conjunto.
Perguntas frequentes
Quanto custa uma consulta da API Deep Research?
Uma tarefa de pesquisa realista – análise competitiva, pesquisa de mercado, pesquisa de literatura – normalmente consome cerca de 50 mil tokens de entrada, 20 mil tokens de saída (incluindo raciocínio oculto) e cerca de 15 chamadas de pesquisa na web. Em o4-mini-deep-research (entrada de US$ 2/m, saída de US$ 8/m), isso chega perto de US$ 0,41 por consulta: cerca de US$ 0,10 de entrada, US$ 0,16 de saída e US$ 0,15 em taxas de pesquisa na web a US$ 10 por 1.000 chamadas. A mesma tarefa na pesquisa profunda o3 (US$ 10/M de entrada, US$ 40/M de saída) custa cerca de US$ 1,45 – cerca de 3,5x mais. Consultas curtas custam menos, mas as taxas de pesquisa estabelecem um limite mínimo para cada consulta, independentemente da duração.
Por que não consigo desativar as cobranças de pesquisa na web?
A pesquisa na Web é o que torna um modelo de pesquisa profunda um modelo de pesquisa profunda – a API realiza suas próprias pesquisas como parte do ciclo de pesquisa, e essas chamadas custam cerca de US$ 10 por 1.000 pesquisas, além dos custos de token. Ao contrário da ferramenta opcional de pesquisa na web em modelos regulares de chat, os modelos de pesquisa profunda pesquisam de forma autônoma e as chamadas não podem ser desativadas. Em consultas curtas, as taxas de pesquisa podem ser o maior item de linha: 15 pesquisas custam US$ 0,15 antes que um único token seja cobrado, e é por isso que as comparações de preços por token subestimam os custos profundos de pesquisa.
Devo usar o3-deep-research ou o4-mini-deep-research?
o4-mini-deep-research custa cerca de 3 a 4 vezes menos por consulta (US$ 2/US$ 8 por milhão de tokens versus US$ 10/US$ 40) e lida com a maioria das tarefas rotineiras de pesquisa – resumos, varreduras competitivas, apuração estruturada de fatos. o3-deep-research é o principal nível para um trabalho de síntese genuinamente difícil, onde a profundidade da análise justifica o pagamento de vários dólares por consulta. Um padrão de produção comum é encaminhar tudo primeiro para o o4-mini e escalar apenas as consultas onde o relatório mais barato se mostra insuficiente – em cargas de trabalho típicas, essa decisão de roteamento altera a fatura mensal em 3,5x.