—por chamada
—por mil chamadas
—nível mais barato
Camadas GPT-5 – mesma carga de trabalho
Tokens e volume de chamadas idênticos, com preços em cada nível GPT-5. O mais barato para esta carga de trabalho está em destaque.
| Nível | Insira $/1 milhão | Saída $/1 milhão | Custo/mês |
|---|
⚠️ Preço de referência GPT-5 (2026): GPT-5,5 $ 5,00/$ 30,00, GPT-5 $ 1,25/$ 10,00, GPT-5 mini $ 0,40/$ 1,60, GPT-5 nano $ 0,10/$ 0,40 por 1 milhão de tokens de entrada/saída. Os preços mudam e variam de acordo com nível, região, lote e entrada em cache – confirme na página de preços da OpenAI. Quer todos os modelos lado a lado? Use o
comparação completa de preços LLM ou o
calculadora de custo de token. ·
Informar preço desatualizado →
✓ Última verificação: 24/07/2026· Fonte: página oficial de preços do fornecedor· Monitorado automaticamente — relatar alteração →
Como funciona o preço da API GPT-5
O GPT-5 é cobrado por token, dividido em entrada (seu prompt mais qualquer contexto que você enviar) e saída (tudo o que o modelo escreve de volta). Em cada nível, a produção custa várias vezes mais do que a entrada – o GPT-5 é Entrada de US$ 1,25/1 milhão e $ 10,00 / produção de 1 milhão, uma lacuna de 8 × - portanto, o comprimento da resposta é a maior alavanca em sua conta. Limite max_tokens, solicitando respostas concisas e o sistema de corte solicita que todos cortem custos diretamente. Como o GPT-5 é um modelo de raciocínio, os tokens de raciocínio ocultos que ele gera antes da resposta final também são cobrados como saída, de modo que o raciocínio passo a passo pesado aparece na conta mesmo quando a resposta visível é curta.
A segunda alavanca é escolha de nível. A família abrange uma ampla faixa de preços: carro-chefe GPT-5.5 por US$ 5,00/US$ 30,00 pelo raciocínio mais difícil e trabalho longo, GPT-5 como padrão equilibrado, GPT-5 mini cerca de um terço do preço do GPT-5 para tarefas diárias, e GPT-5 nano por US$ 0,10/US$ 0,40 para classificação, extração e respostas curtas de alto volume. Um padrão comum é executar um nível mais barato por padrão e reservar GPT-5 ou GPT-5.5 apenas para as solicitações que realmente precisam de qualidade de fronteira – a tabela acima mostra exatamente quanto custa cada nível em seu volume. Para ver o GPT-5 contra Claude, Gemini e o resto, use o Comparação de preços de LLM; para uma análise do zero de como o faturamento por token aumenta, leia como funciona o preço da API LLM ou navegue no Centro de aprendizagem.
Como funciona esta calculadora
Calcule o custo da API GPT-5 a partir de seus tokens de entrada/saída e volume de chamadas, veja a fatura mensal e o custo por chamada e compare GPT-5.5, GPT-5, GPT-5 mini e GPT-5 nano na mesma carga de trabalho para que você possa escolher o nível mais barato que ainda faz o trabalho.
Perguntas frequentes
Quanto custa a API GPT-5?
O preço de referência (2026) é GPT-5 a US$ 1,25 por milhão de tokens de entrada e US$ 10,00 por milhão de tokens de saída. O carro-chefe GPT-5.5 custa $ 5,00 de entrada / $ 30,00 de saída, enquanto GPT-5 mini custa $ 0,40 / $ 1,60 e GPT-5 nano custa $ 0,10 / $ 0,40. Sua fatura é composta por tokens de entrada vezes o preço de entrada mais tokens de saída vezes o preço de saída, multiplicados por quantas chamadas você faz.
Qual é a diferença entre GPT-5, GPT-5 mini e GPT-5 nano?
Eles são a mesma família, com capacidades e preços diferentes. GPT-5 e GPT-5.5 são os níveis de fronteira para raciocínio árduo e trabalho extenso; O GPT-5 mini é aproximadamente 3x mais barato que o GPT-5 para tarefas diárias; GPT-5 nano é o mais barato, voltado para classificação, extração e respostas curtas de grande volume. Combine o nível com a tarefa, em vez de padronizar o modelo superior.
Por que a saída do GPT-5 é mais cara do que a entrada?
Em cada camada GPT-5, o preço de saída (por milhão) é várias vezes o preço de entrada. Os tokens de raciocínio que o modelo gera antes de sua resposta final também são cobrados como saída, portanto, respostas detalhadas e raciocínio pesado impulsionam a conta. Limitar max_tokens e solicitar respostas concisas reduz os custos diretamente.