18 сентября 2026 года · AI & LLMs · 6 минут чтения
When Claude Sonnet 5 launched, Anthropic billed $2 per million input tokens and $10 per million output as introductory pricing — through August 31, 2026, with a step up to $3/$15 scheduled for September 1. I went looking for that increase to update our own pricing page, because it should have landed over two weeks ago. It didn't. Anthropic's official pricing docs now carry a note saying the hike "will not occur" and the $2/$10 launch price is permanent. So I pulled the full Claude 5 family rate card — Fable 5, Opus 5, Sonnet 5, Haiku 4.5 — straight from the source and ran real workloads through it to see what that cancellation is actually worth, and how the four tiers compare once you're not just reading a table.
Возьмите продукт среднего размера: второй пилот службы поддержки, выполняющий 2000 запросов в день, каждый из которых содержит примерно 8000 маркеров извлеченного контекста и истории разговоров, и возвращающий ответ из 500 маркеров. Это 480 миллионов входных токенов и 30 миллионов выходных токенов в месяц — не огромная компания, а просто реальная функция с реальным трафиком.
| Тариф Sonnet 5 | Вход (480 М) | Выход (30 М) | Итого за месяц |
|---|---|---|---|
| Факт: $ 2 / $ 10 за MTok | $960.00 | $300.00 | $1,260.00 |
| Отменено: $ 3 / $ 15 за MTok | $1,440.00 | $450.00 | $1,890.00 |
Это $ 630 в месяц, $ 7,560 в год, что этот продукт не платит, потому что Anthropic отступил от увеличения. Счет за него никто не высылал, никто не писал запрос на изменение — счет просто оставался там, где был. Если вы запланировали на сентябрь повышение, как было сказано в первоначальном объявлении, вы можете вернуть эту строку.
Проверено на соответствие собственным ценовым документам Anthropic, проверено 18.09.2026. Это полная текущая линейка плюс две модели предыдущего поколения, которые все еще используются для существующих интеграций.
| Модель | Вход | 5m cache write | Запись в кэш за 1 час | Кэш | Выход |
|---|---|---|---|---|---|
| Басня Клода 5 | $10.00 | $12.50 | $20.00 | $1.00 | $50.00 |
| Клод Опус 5 | $5.00 | $6.25 | $10.00 | $0.50 | $25.00 |
| Клод Опус 4.8 (та же ставка) | $5.00 | $6.25 | $10.00 | $0.50 | $25.00 |
| Клод Соннет 5 | $2.00 | $2.50 | $4.00 | $0.20 | $10.00 |
| Клод Сонет 4.6 (предыдущее поколение) | $3.00 | $3.75 | $6.00 | $0.30 | $15.00 |
| Клод Хайку 4.5 | $1.00 | $1.25 | $2.00 | $0.10 | $5.00 |
Все цены за миллион токенов. Стоит отметить: Sonnet 5 по цене $ 2/$ 10 теперь подрывает свое предыдущее поколение, Sonnet 4.6 по цене $ 3/$ 15 — новая модель и лучше, и на 33% дешевле, чем та, которую она заменила, что почти никогда не случается при запуске.
Я выполнял ту же месячную нагрузку 480M-входа/30M-выхода во всех четырех текущих моделях, без каких-либо других изменений. Разброс удивил меня не столько размерами, сколько тем, насколько он аккуратен.
| Модель | Ежемесячная стоимость | по сравнению с Haiku 4.5 |
|---|---|---|
| Клод Хайку 4.5 | $630.00 | 1.0x |
| Клод Соннет 5 | $1,260.00 | 2.0x |
| Клод Опус 5 | $3,150.00 | 5.0x |
| Басня Клода 5 | $6,300.00 | 10.0x |
Sonnet costs exactly double Haiku, Opus exactly five times Haiku, Fable exactly ten. Because input and output are both round multiples of Haiku's rate across every tier, the ladder holds for any workload shape, not just this one — which makes back-of-envelope tier comparisons genuinely reliable instead of a rough guess. The real decision isn't "which is cheapest," it's whether the task in front of you needs Opus-or-Fable-grade reasoning, because the cost difference for getting that wrong compounds fast at volume.
Допустим, вы запускаете продукт агента кодирования, который отправляет один и тот же контекст репо из 6000 токенов на каждом последующем ходу в сеансе, а сеанс в среднем составляет 20 оборотов в 5-минутном окне — именно для этого и создан 5-минутный кэш Anthropic. На Sonnet 5: 5-минутная запись в кэш стоит $ 2,50/MTok (1,25x базовый вход), попадание в кэш стоит $ 0,20/MTok (0,1x базовый вход).
| За 20-ти оборотный сеанс | При 50 000 сеансов/мес. | |
|---|---|---|
| Без кэширования (120 000 токенов ctx × $ 2/база MTok) | $0.2400 | $12,000.00 |
| С кэшированием (1 запись + 19 попаданий) | $0.0378 | $1,890.00 |
Это $ 10 110 в месяц назад, сокращение на 84%, за то, что он ничего не изменил в продукте — просто включил кэширование для контекста, который уже был дословно недоволен. Если ваш агент или приложение RAG еще не кэшируют повторяющийся контекст, это единственная позиция с самым высоким кредитным плечом на всей тарифной карте.
Для всего, что не нуждается в оперативном ответе — ночная классификация, массовая маркировка, обратная засыпка — пакетный API - это плоская скидка 50% как на ввод, так и на вывод, для каждой модели без исключений. Классификация 100M-вход /100M-выход на Haiku 4.5 составляет $ 600 по стандартным ставкам и ровно $ 300. Это самая простая экономия на всей этой странице: без изменений архитектуры, просто другая конечная точка и асинхронный результат.
Default to Sonnet 5 unless you've specifically measured that a task needs more. At $2/$10 it now undercuts the model it replaced while scoring higher on Anthropic's own benchmarks, which is the rare case where "use the new default" is also the cheap option. Reach for Opus 5 only where the reasoning gap is visible in your own evals — not because it feels safer — and reserve Fable 5 for the genuinely hard, long-horizon runs where a 10x bill over Haiku is obviously worth it. And turn prompt caching on before you optimize anything else; in the example above it beat every model-tier decision on this page.
Новичок в расценках LLM на основе использования? Начните с бесплатные руководства по стоимости API.
Разверните его самостоятельно: DigitalOcean — бесплатный кредит в размере 200 долларов США ↗ · Хостингер VPS ↗
Pricing verified live against Anthropic's official Claude API pricing docs (platform.claude.com/docs/en/about-claude/pricing), checked 2026-09-18. Reference estimates using Anthropic's published self-serve rates — Bedrock, Google Cloud and Microsoft Foundry pricing, enterprise volume discounts and future rate changes vary; confirm current pricing at the source before budgeting. Workload figures (request volumes, token counts) are illustrative scenarios computed against real published per-token rates, not vendor-supplied numbers.