Tabela de preços completa – sua carga de trabalho
Referência de tokens de $/1 milhão (julho de 2026), custo mensal nos números acima.
| Provedor | Modelo | Em US$/1 milhão | Fora $/1 milhão | Custo / mês |
|---|
Mais barato por caso de uso
- Alto volume/simples (classificação, extração, roteamento): Gemini 2.0 Flash ou GPT-4o mini – centavos por mil solicitações.
- Bots de bate-papo e suporte: GPT-4o mini ou Gemini 2.5 Flash – barato, rápido, bom o suficiente; veja o calculadora de custos do chatbot.
- RAG/contexto longo: Gemini 2.5 Flash ou Pro (o baixo preço de entrada ajuda quando você preenche os pedaços recuperados); veja o Calculadora de custos RAG.
- Raciocínio/codificação difícil: Claude Soneto 4 ou GPT-4o; Claude Opus / o3 somente quando você realmente precisa.
- Precisa de um nível gratuito: Gemini (AI Studio) é o único dos três com uma cota gratuita genuína.
Como realmente escolher
A fidelidade à marca é o hábito mais caro da IA. Os três fornecedores superam-se constantemente, e a verdadeira diferença de custo vem de duas coisas que você controla: o camada de modelo você escolhe e como prolongar suas saídas são. Um modelo de fronteira com respostas curtas pode ser mais barato do que um modelo "barato" com respostas incoerentes. Avalie a carga de trabalho, não o logotipo – a tabela acima faz exatamente isso com base em seus próprios números.
Analise um fornecedor com o Calculadora GPT-4o, o Calculadora Cláudio ou o Calculadora de Gêmeos, compare todos os modelos de uma vez no calculadora completa de custos da API AI, ou estimar um produto inteiro com o Estimador de custos de aplicativos de IA.
Três alavancas reduzem ainda mais a conta depois que você escolhe um modelo, e todos os três fornecedores oferecem todos os três. Cache de prompt reavalia prompts e documentos repetidos do sistema a uma fração da taxa de entrada normal – vale a pena para qualquer aplicativo que reenvie as mesmas instruções ou contexto em cada chamada; dimensione-o no calculadora de economia de cache imediata. UM API em lote oferece cerca de 50% de desconto para trabalhos que podem esperar algumas horas em vez de precisar de uma resposta ao vivo; veja o calculadora de economia de API em lote. E para aplicativos de alto volume, roteamento solicitações de rotina para um modelo mais barato, enquanto reservar o carro-chefe para casos difíceis é muitas vezes a maior alavanca de todas - modele-o no Calculadora de custo do roteador modelo AI.
Mais uma diferença que não aparece na tabela de preços: apenas Gêmeos tem um nível de API gratuito genuíno (Google AI Studio, sem necessidade de cartão), o que o torna a maneira mais barata de criar protótipos antes de comprometer os gastos. OpenAI e Anthropic exigem configuração de faturamento desde a primeira solicitação, embora novas contas recebam crédito de teste limitado.
Perguntas frequentes
Qual é mais barato: OpenAI, Claude ou Gemini? Para o modelo mais barato, Gemini 2.0 Flash (US$ 0,10/US$ 0,40 por 1 milhão de tokens) e GPT-4o mini (US$ 0,15/US$ 0,60) lideram. Entre os carros-chefe, o Gemini 2.5 Pro tem o preço de entrada mais baixo, o GPT-4o fica no meio e o Claude Opus é o mais caro – o vencedor depende do nível que você precisa, não da marca.
Claude é mais caro que o GPT-4o? Claude Sonnet 4 (US$ 3/US$ 15) é um pouco mais caro que o GPT-4o (US$ 2,50/US$ 10), e Claude Opus 4 é muito mais caro – mas Claude Haiku 3.5 supera o GPT-4o. Compare a carga de trabalho que você realmente executa, já que o comprimento da saída domina a conta.
Todos os três suportam cache imediato e descontos em lote? Sim – todos os três oferecem cache para prompts repetidos e uma API em lote por aproximadamente metade do preço. A economia real depende de quão repetitivos são seus prompts e se seu trabalho pode tolerar o atraso do lote.
Algum dos três tem um nível de API gratuito? Gemini é o único – o Google AI Studio oferece acesso gratuito com limites de taxas generosos o suficiente para prototipagem. OpenAI e Anthropic exigem a configuração do faturamento primeiro, embora ambos concedam crédito de avaliação limitado para novas contas.