Publicado em 11/07/2026 · baseado em nosso novo Rastreador de histórico de preços LLM – todos os principais eventos de preços desde GPT-4, com datas
Compilamos todas as principais alterações de preço da API LLM de março de 2023 até hoje em um só linha do tempo. O padrão é mais consistente do que esperávamos e quebra a maioria das planilhas de orçamento de IA que vimos: com capacidade constante, os preços caem cerca de 10 vezes por ano. Não gradualmente – em etapas, e geralmente em direções que ninguém previu.
| Data | Entrada de classe de fronteira, US$/1 milhão | vs lançamento do GPT-4 |
|---|---|---|
| Março de 2023 (GPT-4) | $30.00 | — |
| Agosto de 2024 (GPT-4o após corte) | $2.50 | −92% |
| 2026 (anfitriões de peso aberto) | <US$ 1,00 | −97% |
Preços de tabela históricos. Linha do tempo completa com 14 eventos datados no página de histórico de preços.
O mecanismo é importante: modelos individuais raramente ficam mais baratos (os dois cortes do GPT-4o foram a exceção). O que realmente acontece é substituição — cada nova geração é enviada no nível inferior da geração anterior. O GPT-4o mini venceu o GPT-3.5 Turbo por um terço do seu preço. DeepSeek V2 ofereceu qualidade quase fronteiriça por US$ 0,14. Você não enfrenta a deflação esperando por descontos; você aproveita comprando novamente o nível.
Contratos anuais com taxas de hoje. Um desconto por volume de 30% bloqueado por 12 meses é uma perda se os preços de mercado caírem de 60 a 90% nesse período – e historicamente, isso aconteceu. Qualquer coisa além de um compromisso de 6 a 12 meses é uma aposta contra uma tendência de três anos. Se você precisa se comprometer, comprometa-se com os gastos, não com a tabela de preços de um modelo específico.
Decisões de “IA é muito cara para esse recurso”. Um recurso que hoje custa US$ 10 mil/mês provavelmente custará US$ 1 a 3 mil com qualidade igual em 18 meses. A economia unitária marginal agora geralmente significa uma boa economia unitária em breve – o cálculo de construção versus espera deve incluir a curva, e não apenas o adesivo de hoje.
Integração profunda com um único fornecedor. Ambos os choques descontínuos de preços em nosso cronograma (maio de 2024, janeiro de 2025) vieram do DeepSeek – um estranho. Equipes com roteamento independente de provedor capturaram esses preços em dias; equipes unidas a um SDK assistidas do lado de fora. O custo de engenharia de uma camada de abstração é um prêmio de seguro no próximo choque.
Duas advertências honestas dos dados. Primeiro, preços de produção caem mais lentamente — GPT-4 lançado com saída em 2× entrada; hoje as proporções de 4–5× são padrão. Cargas de trabalho com muitos resultados (geração de código, respostas longas) esvaziam significativamente mais lentamente do que o título. Segundo, os preços sobem: Claude 3.5 Haiku foi lançado por 3,2x o preço de seu antecessor porque foi comparado como um modelo intermediário. O nível barato de permanecer barato é um hábito, não uma garantia – nunca codifique isso.
Trimestralmente, quinze minutos: coloque seu mix real de tokens no Comparação de mais de 300 modelos e verifique se o seu modelo atual ainda ganha seu nível. Quando isso não acontece, o calculadora de economia de queda de preço precifica a migração. A maioria das equipes que modelamos encontra uma economia de 30 a 60% na primeira vez que faz isso – dinheiro que estava na mesa simplesmente porque a escolha do modelo foi feita há dois trimestres.
Todos os números são preços de tabela históricos, compilados em julho de 2026 – detalhes e fontes no página de histórico de preços. Relacionado: Comparação de preços do modelo AI · Economia de roteamento de modelo · API LLM mais barata.