✓ Última verificação: 15/08/2026· Fonte: página oficial de preços do fornecedor· Monitorado automaticamente — relatar alteração →
Cole suas contagens de tokens de entrada e saída e veja exatamente quanto custa uma chamada em cada modelo principal – classificado primeiro como o mais barato. A maneira mais rápida de comparar preço de GPT, Claude, Gemini e DeepSeek.
Os provedores definem o preço dos tokens de entrada e saída separadamente — e a produção geralmente custa 3 a 5 vezes mais que o insumo. Portanto, uma solicitação curta com uma resposta longa pode custar mais do que uma solicitação longa com uma resposta curta. Insira seus dois números e veja o custo real por chamada em todos os modelos.
—
mais barato / ligue
—modelo mais barato
—total de chamadas
—tokens / chamada
Custo por chamada por modelo
Seu token conta, cada modelo classificado como mais barato primeiro. Os preços são por 1 milhão de tokens.
Modelo
Em US$/1 milhão
Fora $/1 milhão
Custo / chamada
⚠️ Estimativa usando preços de referência (julho de 2026) e taxas de tabela. Os preços reais mudam e variam de acordo com nível, região, duração do contexto e descontos em cache/lote. Para contexto repetido, consulte cache de prompt; para trabalhos assíncronos em massa, consulte preços em lote. · Informar preço desatualizado →
Como funciona o custo do token
A fórmula é simples: custo = (tokens de entrada ÷ 1.000.000 × preço de entrada) + (tokens de saída ÷ 1.000.000 × preço de saída). Os dois preços são propositalmente diferentes – gerar texto (saída) é mais caro do que lê-lo (entrada), normalmente de 3 a 5×. É por isso que a maior alavanca na sua conta geralmente é limitando o comprimento da saída, não cortando o prompt. Como um guia aproximado, 1.000 tokens ≈ 750 palavras em inglês, mas o código e outras linguagens são tokenizados de maneira diferente, portanto, meça com o tokenizer do provedor para obter números exatos.
O Calculadora de custo de token LLM estima quanto custa uma chamada de API de modelo de linguagem única com base no número de tokens de entrada você envia e o tokens de saída o modelo retorna. Como os provedores fixam o preço dos tokens de entrada e saída em taxas diferentes por milhão, ambas as contagens determinam o total, e os tokens de saída são geralmente os mais caros dos dois. Você também pode inserir um contagem de chamadas para projetar o custo em muitas solicitações idênticas. A ferramenta aplica as taxas publicadas de cada modelo e depois classifica os resultados mais barato primeiro entre provedores como GPT, Claude, Gemini e DeepSeek, para que você possa comparar a mesma carga de trabalho lado a lado.
A principal compensação a ser observada é que o preço mais baixo por token nem sempre é o custo real mais baixo. Um modelo que produz respostas mais longas e detalhadas pode queimar mais tokens de saída e acabar sendo mais caro do que um modelo nominalmente mais caro. Faça uma estimativa com contagens de tokens que reflitam seu real prompts e comprimento típico de resposta, já que um teste curto raramente prevê o volume de produção. Verifique novamente a classificação sempre que o tamanho do prompt, a saída esperada ou a frequência da chamada mudarem, porque a opção mais barata pode mudar conforme qualquer uma dessas entradas se move.
Perguntas frequentes
Como é calculado o custo do token LLM?
Custo = (tokens de entrada / 1.000.000 × preço de entrada) + (tokens de saída / 1.000.000 × preço de saída). Os provedores definem o preço da entrada e da saída separadamente, e a saída geralmente é de 3 a 5 vezes mais cara do que a entrada, portanto, respostas longas custam mais do que solicitações longas.
Quantos tokens vale uma palavra?
Para inglês, aproximadamente 1 token equivale a cerca de 0,75 palavras, então 1.000 tokens equivalem a cerca de 750 palavras. Código, números e outras linguagens são tokenizadas de maneira diferente, portanto, sempre meça com o tokenizer do provedor para obter contagens exatas.