2026 年 8 月 2 日発行 · 387 モデル登録からの参考価格。予算を立てる前に確認してください。
「小型モデルを使用してください」というのが標準的なコストのアドバイスです。最終的に、モデル登録全体で適切に価格を設定しましたが、アドバイス自体はほとんど無意味であることが判明しました。 Anthropic のラインナップ内で 1 つのティアをダウングレードすると、コストを節約できます 40%。 Google のラインナップ内でまったく同じ動きをすることで、 96%。同じ決定、同じ量のエンジニアリング作業でも、見返りは大きく異なります。ベンダーの主力製品とその安価な製品との差は一定ではないからです。範囲は 1.7 倍から 24 倍です。
1ヶ月、 2億の入力トークンと4,000万の出力トークン。これは、800 トークンの入力と 160 のトークン出力でおよそ 250,000 のリクエストに相当します。これは、分類、要約、短いチャット返信を行う実際の製品です。キャッシュや一括割引がないため、数値は同等のままです。以下のすべての価格は、追跡されたレジストリに基づいています (387 モデル、2026 年 7 月から 8 月の参考価格)。
| 家族 | 階層 | 100 万ドルあたり | 100 万ドルあたりのアウト | 月 |
|---|---|---|---|---|
| OpenAI | GPT-5.5 | $5.00 | $30.00 | $2,200 |
| GPT-5 | $1.25 | $10.00 | $650 | |
| GPT-5ミニ | $0.40 | $1.60 | $144 | |
| GPT-5ナノ 最安 | $0.10 | $0.40 | $36 | |
| 人間的 | クロード 作品4.8 | $5.00 | $25.00 | $2,000 |
| クロード・ソネット 4.6 | $3.00 | $15.00 | $1,200 | |
| クロード俳句 4.5 | $1.00 | $5.00 | $400 | |
| グーグル | ジェミニ 3.1 プロ | $2.00 | $12.00 | $880 |
| ジェミニ 3.1 フラッシュ | $0.10 | $0.40 | $36 | |
| ジェミニ 3.1 フラッシュライト | $0.05 | $0.20 | $18 | |
| xAI | グロク4 | $3.00 | $15.00 | $1,200 |
| グロク 4 ミニ | $0.50 | $2.50 | $200 | |
| ディープシーク | ディープシーク V4 | $0.27 | $1.10 | $98 |
| ディープシーク V4 フラッシュ | $0.14 | $0.28 | $39 | |
| ミストラル | ミストラル・ラージ | $2.00 | $6.00 | $640 |
| ミストラル スモール | $0.10 | $0.30 | $32 |
ほとんどのチームが実際に検討している動きを除くすべてを取り除き、すぐ下の層に旗艦を配置します。
| 動く | 前→後 | 保存されました |
|---|---|---|
| 作品4.8 → ソネット4.6 | $2,000 → $1,200 | 40% |
| DeepSeek V4 → V4 フラッシュ | $98 → $39 | 60% |
| GPT-5.5 → GPT-5 | $2,200 → $650 | 70% |
| Grok 4 → Grok 4 ミニ | $1,200 → $200 | 83% |
| ミストラル 大→小 | $640 → $32 | 95% |
| Gemini 3.1 Pro → フラッシュ | $880 → $36 | 96% |
40 パーセント対 96 パーセント。どちらも「小さいモデルを使用する」です。そのうちの 1 つは、評価作業とルーティング層をスプリントする価値があります。もう 1 つは、節約できる 800 ドルよりも、Sonnet が十分であることを証明するためにエンジニアに費やす時間の方が長いため、せいぜい午後の価値があります。
これは Anthropic が値引きをケチっているわけではありません。それは逆で、主力製品は劇的に安くなりました。 Claude Opus 4.1 は次のレジストリにあります。 $15/$75。 Opus 4.5、4.6、4.8 はすべて次の位置にあります。 $5/$25 — Sonnet または Haiku の価格は変更せずに、ラインナップの最上位を 3 倍に値下げします。私の 2 億 4,000 万トークンの月では、Opus が 6,000 ドルから 2,000 ドルになりました。
副作用として、オーパスとソネットのギャップは 5 倍から 1.67 倍に崩壊しました。アンスロピックにおけるフロンティア税はほとんど存在しなくなった。 OpenAI は別の軸で同じことを行いました。15/60 ドルの o1 は 1.25/10 ドルの GPT-5 に置き換えられました。そのため、人々が 2025 年に予算を立てる高価なフロンティア モデルのラインアイテムは、現在では桁違いです。
Googleは別の道を歩みました。彼らは Pro の価格を 2 ドル/12 ドルと手頃な価格に保ち、Flash-Lite を 0.05 ドル/0.20 ドルに引き下げたので、その内部スプレッドは現在、主要なファミリーの中で最も広いです。それは偶然ではありません。それはルーティング ピッチです。
Gemini 3.1 フラッシュのコスト $36 このワークロードに関しては。 DeepSeek V4 は心の中で「安価なオプション」と考えていましたが、コストがかかります $98 — ほぼ 3 倍以上です。 GPT-5.5 は 2,200 ドルです Gemini 3.1 Flash-Lite の価格の 122 倍 同じトークン量の移動には 18 ドルがかかります。
私は2年前のメンタルプライスランキングを持ち歩いていました。それは両方の方向で間違っていました。格安ベンダーの評判は実際の価格表より約 1 年遅れており、その数字の推移は民間伝承よりも速いです。
1. ルーターを構築する前に、階層ギャップを確認します。 フラッグシップからミニへの速度が 2 倍未満の場合、カスケードは複雑さや評価予算に見合う価値がありません。私はフラッグシップを採用し、代わりにプロンプト キャッシングに労力を費やし、より多くのコストを削減します。
2. ギャップが 20 倍の場合は、積極的にルーティングします。 安価な層は、分類、抽出、タグ付け、ルーティングを処理します。旗艦は、信頼性チェックで不合格になったものだけを確認します。 Google スプレッドでは、10% のエスカレーション レートで 880 ドルが 60 ドル近くに変わります。計算は次のとおりです。 LLM カスケード節約計算ツール そして モデル ルーティングの節約計算ツール.
3. 四半期ごとに全ラインナップの価格を変更します。 Opus の価格改定により、どの最適化を行う価値があるかが変わりましたが、私はそのことに数週間遅れて気づきました。それが、 価格変動トラッカー 今のところです。
4. 私は投入価格だけで比較することは決してありません。 出力は、私がチェックした 97 個のファーストパーティ チャット モデル全体で中央値で 4 倍の入力を実行し、GPT-5.5 および Gemini 3.1 Pro では 6 倍を実行します。安価な入力レートでのおしゃべりなモデルが、高価なレートでの簡潔なモデルに負ける頻度は、人々が予想しているよりも高いです。アプリがモデルを切り替える場合、移行コストも重要になります。「 モデル移行コスト計算ツール.
独自のトークン分割を AI API コスト計算ツール →、または完全な製品をモデル化します。 AI アプリのコスト見積りツール そして チャットボットのコスト計算ツール。トークンの価格設定は初めてですか?から開始 学ぶ: API の価格設定の仕組み.
追跡モデル レジストリから取得した 2026 年 8 月の参考推定値。価格は予告なく変更され、キャッシュ割引、バッチ割引、ボリューム割引は含まれません。予算を決める前にプロバイダーに確認してください。 OpenAI、Anthropic、Google、xAI、DeepSeek、Mistral とは提携していません。