mais barato capaz
mais barato / mês
spread principal / mês

Tabela de preços completa – sua carga de trabalho

Referência de tokens de $/1 milhão (julho de 2026), custo mensal nos números acima.

ProvedorModeloEm US$/1 milhãoFora $/1 milhãoCusto / mês

Mais barato por caso de uso

⚠️ Preços de referência, julho de 2026 — todos os três fornecedores alteram os preços regularmente. Confirme na página de preços de cada provedor. A produção é cobrada separadamente e custa mais do que a entrada em cada modelo. · Informar preço desatualizado →
✓ Última verificação: 15/08/2026· Fonte: página oficial de preços do fornecedor· Monitorado automaticamente — relatar alteração →

Como realmente escolher

A fidelidade à marca é o hábito mais caro da IA. Os três fornecedores superam-se constantemente, e a verdadeira diferença de custo vem de duas coisas que você controla: o camada de modelo você escolhe e como prolongar suas saídas são. Um modelo de fronteira com respostas curtas pode ser mais barato do que um modelo "barato" com respostas incoerentes. Avalie a carga de trabalho, não o logotipo – a tabela acima faz exatamente isso com base em seus próprios números.

Analise um fornecedor com o Calculadora GPT-4o, o Calculadora Cláudio ou o Calculadora de Gêmeos, compare todos os modelos de uma vez no calculadora completa de custos da API AI, ou estimar um produto inteiro com o Estimador de custos de aplicativos de IA.

Três alavancas reduzem ainda mais a conta depois que você escolhe um modelo, e todos os três fornecedores oferecem todos os três. Cache de prompt reavalia prompts e documentos repetidos do sistema a uma fração da taxa de entrada normal – vale a pena para qualquer aplicativo que reenvie as mesmas instruções ou contexto em cada chamada; dimensione-o no calculadora de economia de cache imediata. UM API em lote oferece cerca de 50% de desconto para trabalhos que podem esperar algumas horas em vez de precisar de uma resposta ao vivo; veja o calculadora de economia de API em lote. E para aplicativos de alto volume, roteamento solicitações de rotina para um modelo mais barato, enquanto reservar o carro-chefe para casos difíceis é muitas vezes a maior alavanca de todas - modele-o no Calculadora de custo do roteador modelo AI.

Mais uma diferença que não aparece na tabela de preços: apenas Gêmeos tem um nível de API gratuito genuíno (Google AI Studio, sem necessidade de cartão), o que o torna a maneira mais barata de criar protótipos antes de comprometer os gastos. OpenAI e Anthropic exigem configuração de faturamento desde a primeira solicitação, embora novas contas recebam crédito de teste limitado.

Perguntas frequentes

Qual é mais barato: OpenAI, Claude ou Gemini? Para o modelo mais barato, Gemini 2.0 Flash (US$ 0,10/US$ 0,40 por 1 milhão de tokens) e GPT-4o mini (US$ 0,15/US$ 0,60) lideram. Entre os carros-chefe, o Gemini 2.5 Pro tem o preço de entrada mais baixo, o GPT-4o fica no meio e o Claude Opus é o mais caro – o vencedor depende do nível que você precisa, não da marca.

Claude é mais caro que o GPT-4o? Claude Sonnet 4 (US$ 3/US$ 15) é um pouco mais caro que o GPT-4o (US$ 2,50/US$ 10), e Claude Opus 4 é muito mais caro – mas Claude Haiku 3.5 supera o GPT-4o. Compare a carga de trabalho que você realmente executa, já que o comprimento da saída domina a conta.

Todos os três suportam cache imediato e descontos em lote? Sim – todos os três oferecem cache para prompts repetidos e uma API em lote por aproximadamente metade do preço. A economia real depende de quão repetitivos são seus prompts e se seu trabalho pode tolerar o atraso do lote.

Algum dos três tem um nível de API gratuito? Gemini é o único – o Google AI Studio oferece acesso gratuito com limites de taxas generosos o suficiente para prototipagem. OpenAI e Anthropic exigem a configuração do faturamento primeiro, embora ambos concedam crédito de avaliação limitado para novas contas.