HomeBlog > Preços da família Claude 5 e a caminhada cancelada do Soneto 5

O aumento de preço do Claude Sonnet 5 foi cancelado: o que a família Claude 5 realmente custa

18 de setembro de 2026 · IA e LLMs · 6 min de leitura

When Claude Sonnet 5 launched, Anthropic billed $2 per million input tokens and $10 per million output as introductory pricing — through August 31, 2026, with a step up to $3/$15 scheduled for September 1. I went looking for that increase to update our own pricing page, because it should have landed over two weeks ago. It didn't. Anthropic's official pricing docs now carry a note saying the hike "will not occur" and the $2/$10 launch price is permanent. So I pulled the full Claude 5 family rate card — Fable 5, Opus 5, Sonnet 5, Haiku 4.5 — straight from the source and ran real workloads through it to see what that cancellation is actually worth, and how the four tiers compare once you're not just reading a table.

Quanto vale a caminhada cancelada

Pegue um produto de tamanho médio: um copiloto de suporte que faz 2.000 solicitações por dia, cada uma carregando cerca de 8.000 tokens de contexto recuperado e histórico de conversas e retornando uma resposta de 500 token. São 480 milhões de tokens de entrada e 30 milhões de tokens de saída por mês — não uma grande empresa, apenas um recurso real com tráfego real.

Taxa do soneto 5Entrada (480M)Saída (30M)Total mensal
Real: $ 2 / $ 10 por MTok$960.00$300.00$1,260.00
Cancelado: $ 3 / $ 15 por MTok$1,440.00$450.00$1,890.00

São $ 630 por mês, $ 7.560 por ano, que este produto não está pagando porque a Anthropic recuou no aumento. Ninguém enviou uma fatura para isso, ninguém escreveu um pedido de alteração — a conta apenas ficou onde estava. Se você fez o orçamento para o aumento de setembro como o anúncio original lhe disse, pode colocar essa linha de volta.

A tabela DE preços completa DA família Claude 5

Verificado em relação aos próprios documentos de preços da Anthropic, verificados em 18/09/2026. Esta é a linha atual completa mais os dois modelos da geração anterior ainda servidos para integrações existentes.

ModeloEntradaGravação de cache de 5mGravação de cache de 1hsolicitação à memória cache com sucessoSaída
Claude Fable 5$10.00$12.50$20.00$1.00$50.00
Claude Opus 5$5.00$6.25$10.00$0.50$25.00
Cláudio Opus 4.8 mesmo ritmo$5.00$6.25$10.00$0.50$25.00
Claude Sonnet 5$2.00$2.50$4.00$0.20$10.00
Soneto de Claude 4.6 (geração anterior)$3.00$3.75$6.00$0.30$15.00
Claude Haiku 4.5$1.00$1.25$2.00$0.10$5.00

Todos os preços por milhão de tokens. Vale a pena notar: o Soneto 5 a US $ 2/US $ 10 agora prejudica sua própria geração anterior, o Soneto 4.6 a US $ 3/US $ 15 — o novo modelo é melhor e 33% mais barato do que o que substituiu, o que quase nunca acontece em um lançamento.

Mesma carga de trabalho, quatro níveis — uma escada limpa de 10x

Executei essa mesma carga de trabalho mensal de 480M de entrada/30M de saída em todos os quatro modelos atuais, sem outras alterações. O spread me surpreendeu menos pelo tamanho do que pelo quão arrumado ele é.

ModeloCusto mensalvs Haiku 4.5
Claude Haiku 4.5$630.001.0x
Claude Sonnet 5$1,260.002.0x
Claude Opus 5$3,150.005.0x
Claude Fable 5$6,300.0010.0x

Sonnet costs exactly double Haiku, Opus exactly five times Haiku, Fable exactly ten. Because input and output are both round multiples of Haiku's rate across every tier, the ladder holds for any workload shape, not just this one — which makes back-of-envelope tier comparisons genuinely reliable instead of a rough guess. The real decision isn't "which is cheapest," it's whether the task in front of you needs Opus-or-Fable-grade reasoning, because the cost difference for getting that wrong compounds fast at volume.

O que o cache realmente salva, com números reais

Digamos que você esteja executando um produto de agente de codificação que reenvia o mesmo contexto de repositório de 6.000 tokens em cada turno de acompanhamento dentro de uma sessão, e uma sessão tem em média 20 turnos dentro de uma janela de 5 minutos — exatamente para o que o cache de 5 minutos do Anthropic é construído. No Sonnet 5: uma gravação de cache de 5 minutos custa $ 2,50/MTok (1,25x entrada base), um hit de cache custa $ 0,20/MTok (0,1x entrada base).

Por sessão de 20 turnosA 50.000 sessões/mês
Sem cache (120.000 tokens ctx × $ 2/base MTok)$0.2400$12,000.00
Com cache (1 gravação + 19 acessos)$0.0378$1,890.00

Isso é $ 10.110 por mês atrás, um corte de 84%, por não mudar nada sobre o produto — apenas ativando o cache para um contexto que já estava sendo reenviado literalmente. Se o seu agente ou aplicativo RAG ainda não estiver armazenando em cache o contexto repetido, este é o item de linha de maior alavancagem em toda a tabela de preços.

API em lote: a outra alavanca, se puder esperar

Para qualquer coisa que não precise de uma resposta ao vivo — classificação durante a noite, marcação em massa, aterros — a API em lote tem 50% de desconto tanto na entrada quanto na saída, em todos os modelos, sem exceções. Uma classificação de 100M de entrada/100M de saída executada no Haiku 4.5 é de $ 600 a taxas padrão e exatamente $ 300 em lote. É o salvamento mais simples em toda esta página: nenhuma mudança de arquitetura, apenas um endpoint diferente e um resultado assíncrono.

O que eu realmente executaria

Default to Sonnet 5 unless you've specifically measured that a task needs more. At $2/$10 it now undercuts the model it replaced while scoring higher on Anthropic's own benchmarks, which is the rare case where "use the new default" is also the cheap option. Reach for Opus 5 only where the reasoning gap is visible in your own evals — not because it feels safer — and reserve Fable 5 for the genuinely hard, long-horizon runs where a 10x bill over Haiku is obviously worth it. And turn prompt caching on before you optimize anything else; in the example above it beat every model-tier decision on this page.

Novo nos preços de LLM baseados no uso? Comece com o guias gratuitos de custo de API.

Implemente você mesmo: DigitalOcean – crédito grátis de $ 200 ↗ · VPS Hostinger ↗

Pricing verified live against Anthropic's official Claude API pricing docs (platform.claude.com/docs/en/about-claude/pricing), checked 2026-09-18. Reference estimates using Anthropic's published self-serve rates — Bedrock, Google Cloud and Microsoft Foundry pricing, enterprise volume discounts and future rate changes vary; confirm current pricing at the source before budgeting. Workload figures (request volumes, token counts) are illustrative scenarios computed against real published per-token rates, not vendor-supplied numbers.