HomeBlog › La tarification famille Claude 5 et l'annulation de la randonnée Sonnet 5

La hausse des prix de Claude Sonnet 5 a été annulée : ce que la famille Claude 5 coûte réellement

18 septembre 2026 · AI & LLM · 6 min de lecture

When Claude Sonnet 5 launched, Anthropic billed $2 per million input tokens and $10 per million output as introductory pricing — through August 31, 2026, with a step up to $3/$15 scheduled for September 1. I went looking for that increase to update our own pricing page, because it should have landed over two weeks ago. It didn't. Anthropic's official pricing docs now carry a note saying the hike "will not occur" and the $2/$10 launch price is permanent. So I pulled the full Claude 5 family rate card — Fable 5, Opus 5, Sonnet 5, Haiku 4.5 — straight from the source and ran real workloads through it to see what that cancellation is actually worth, and how the four tiers compare once you're not just reading a table.

Ce que vaut réellement la randonnée annulée

Prenez un produit de taille moyenne : un copilote de support effectuant 2 000 demandes par jour, chacune contenant environ 8 000 jetons de contexte et d'historique de conversation récupérés, et renvoyant une réponse de 500 jetons. Cela représente 480 millions de jetons d'entrée et 30 millions de jetons de sortie par mois — pas une énorme entreprise, juste une véritable fonctionnalité avec un trafic réel.

Tarif Sonnet 5Entrée (480 M)Sortie (30M)Total mensuel
Réel : 2 $ / 10 $ par MTok$960.00$300.00$1,260.00
Annulé : 3 $ / 15 $ par MTok$1,440.00$450.00$1,890.00

C'est 630 $ par mois, 7 560 $ par an, que ce produit ne paie pas car Anthropic a renoncé à l'augmentation. Personne n'a envoyé de facture pour cela, personne n'a écrit de demande de modification — la facture est juste restée là où elle était. Si vous avez budgétisé pour l'étape de septembre comme l'annonce initiale vous l'avait dit, vous pouvez remettre cette ligne.

La carte de tarification familiale complète Claude 5

Vérifié par rapport aux propres documents de tarification d'Anthropic, vérifié 2026-09-18. Il s'agit de la gamme actuelle complète ainsi que des deux modèles de la génération précédente encore utilisés pour les intégrations existantes.

ModèleSaisir5m écriture en cache1h d'écriture en cacheCache coupSortir
Claude Fable 5$10.00$12.50$20.00$1.00$50.00
Claude Opus 5$5.00$6.25$10.00$0.50$25.00
Claude Opus 4.8 (même taux)$5.00$6.25$10.00$0.50$25.00
Claude Sonnet 5$2.00$2.50$4.00$0.20$10.00
Claude Sonnet 4.6 (génération précédente)$3.00$3.75$6.00$0.30$15.00
Claude Haïku 4.5$1.00$1.25$2.00$0.10$5.00

Tous les prix par million de jetons. À noter : le Sonnet 5 à 2 $ / 10 $ sape maintenant sa propre génération précédente, le Sonnet 4.6 à 3 $ / 15 $ — le nouveau modèle est à la fois meilleur et 33% moins cher que celui qu'il a remplacé, ce qui n'arrive presque jamais lors d'un lancement.

Même charge de travail, quatre niveaux — une échelle 10x propre

J'ai exécuté cette même charge de travail mensuelle de 480 M d'entrées/30 M de sorties sur les quatre modèles actuels, sans aucun autre changement. Le spread m'a moins surpris par sa taille que par son rangement.

ModèleCoût mensuelvs Haiku 4.5
Claude Haïku 4.5$630.001.0x
Claude Sonnet 5$1,260.002.0x
Claude Opus 5$3,150.005.0x
Claude Fable 5$6,300.0010.0x

Sonnet costs exactly double Haiku, Opus exactly five times Haiku, Fable exactly ten. Because input and output are both round multiples of Haiku's rate across every tier, the ladder holds for any workload shape, not just this one — which makes back-of-envelope tier comparisons genuinely reliable instead of a rough guess. The real decision isn't "which is cheapest," it's whether the task in front of you needs Opus-or-Fable-grade reasoning, because the cost difference for getting that wrong compounds fast at volume.

Ce que la mise en cache enregistre réellement, avec des nombres réels

Supposons que vous exécutez un produit d'agent de codage qui renvoie le même contexte repo de 6 000 jetons à chaque tour de suivi dans une session, et qu'une session fait en moyenne 20 tours dans une fenêtre de 5 minutes — exactement ce pour quoi le cache de 5 minutes d'Anthropic est conçu. Sur le Sonnet 5 : une écriture de cache de 5 minutes coûte 2,50 $ / MTok (1,25x entrée de base), un coup de cache coûte 0,20 $ / MTok (0,1 x entrée de base).

Par session de 20 toursÀ 50 000 séances/mois
Pas de mise en cache (120 000 jetons ctx × 2 $ / base MTok)$0.2400$12,000.00
Avec mise en cache (1 écriture + 19 hits)$0.0378$1,890.00

C'est 10 110 $ par mois, soit une réduction de 84 %, pour n'avoir rien changé au produit — il suffit d'activer la mise en cache pour le contexte qui était déjà renvoyé mot pour mot. Si votre agent ou votre application RAG ne met pas encore en cache son contexte répété, il s'agit de l'élément de ligne à effet de levier le plus élevé sur l'ensemble de la carte tarifaire.

Batch API : l'autre levier, si vous pouvez attendre

Pour tout ce qui n'a pas besoin d'une réponse en direct — classification du jour au lendemain, marquage en vrac, remblais — l'API Batch offre une réduction de 50 % sur les entrées et les sorties, sur tous les modèles, sans exception. Une classification de 100 M d'entrées/100 M de sorties exécutée sur Haiku 4.5 est de 600 $ aux tarifs standard et exactement de 300 $ par lots. C'est l'économie la plus simple sur toute cette page : pas de changement d'architecture, juste un point de terminaison différent et un résultat asynchrone.

Ce que je courrais réellement

Default to Sonnet 5 unless you've specifically measured that a task needs more. At $2/$10 it now undercuts the model it replaced while scoring higher on Anthropic's own benchmarks, which is the rare case where "use the new default" is also the cheap option. Reach for Opus 5 only where the reasoning gap is visible in your own evals — not because it feels safer — and reserve Fable 5 for the genuinely hard, long-horizon runs where a 10x bill over Haiku is obviously worth it. And turn prompt caching on before you optimize anything else; in the example above it beat every model-tier decision on this page.

Nouveau dans la tarification LLM basée sur l'utilisation ? Commencez par le guides gratuits sur les coûts des API.

Déployez-le vous-même : DigitalOcean — 200 $ de crédit gratuit ↗ · VPS Hostinger ↗

Pricing verified live against Anthropic's official Claude API pricing docs (platform.claude.com/docs/en/about-claude/pricing), checked 2026-09-18. Reference estimates using Anthropic's published self-serve rates — Bedrock, Google Cloud and Microsoft Foundry pricing, enterprise volume discounts and future rate changes vary; confirm current pricing at the source before budgeting. Workload figures (request volumes, token counts) are illustrative scenarios computed against real published per-token rates, not vendor-supplied numbers.