公開日 2026-06-30 · 参考価格、予算を立てる前に確認してください
2026 年の LLM 価格戦争は新たな形をとります。 xAIのグロク はコストリーダーとして議論に積極的に参加しており、OpenAIとGoogleは明確な予算層とプレミアム層に分かれており、AnthropicのClaudeは依然として価格のはしごの頂点に座っている。比較を正直にするために、私たちはいつもと同じことを行いました。つまり、1 つのワークロードを修正し、すべての主要モデルで価格を設定しました。仕事: 1,000,000 件のリクエスト、 それぞれ 1,000 個の入力トークンと 500 個の出力トークン (典型的な短いチャットまたはジェネレーションコール)。これは、10 億の入力トークンと 5 億の出力トークンに相当します。
| モデル | 100 万ドルあたり | アウト $/100 万 | 100万リクエストのコスト |
|---|---|---|---|
| Grok 4.1 高速 最安のフロンティア | $0.20 | $0.50 | $450 |
| ディープシーク V3 | $0.27 | $1.10 | $820 |
| GPT-5.4ミニ | $0.40 | $1.60 | $1,200 |
| ジェミニ 2.5 フラッシュ | $0.30 | $2.50 | $1,550 |
| ジェミニ 3.1 プロ | $2.00 | $12.00 | $8,000 |
| GPT-5.4 | $2.50 | $15.00 | $10,000 |
| Grok 4 (フラッグシップ) | $3.00 | $15.00 | $10,500 |
| クロード 作品4.6 | $5.00 | $25.00 | $17,500 |
価格は参考見積り、2026 年 7 月。 古い価格を報告する →
同じ仕事量でも、 Grok 4.1 Fast では 450 ドル、Claude Opus 4.6 では 17,500 ドル — ~39倍のスプレッド。 AI の請求に関する唯一の最大の決定は、依然としてどのモデルにルーティングするかということですが、2026 年にはフロンティアの安価な端が xAI に移行しました。
Grokは価格に積極的でした。 0.20 ドル/0.50 ドルの xAI の高速層は、出力では DeepSeek さえも下回り、西洋のフロンティア モデルのすべてをはるかに下回っています。これは、巨大なコンテキスト ウィンドウとライブ X データがバンドルされた意図的な土地収奪です。 OpenAI と Google は分岐しました。 現在、それぞれに本当に安価な小型モデル (GPT-5.4 mini、Gemini 2.5 Flash) と高価なフラッグシップモデル (GPT-5.4、Gemini 3.1 Pro) があるため、「OpenAI と Google のどちらが安いでしょうか?」どの層を意味するかによって完全に異なります。 クロードはプレミアムのままでした。 Opus は依然としてメジャーの中でトークンあたりの価格が最も高価です。Anthropic はコストのリーダーシップではなく、機能と信頼性を重視して価格を設定しています。予算に制約がある場合は、Opus ではなく、Claude Haiku (はるかに安価) を検討してください。
この表で勝った数字が自動的にプロジェクトに勝つわけではありません。再試行が必要だったり、長い回答を書いたり、難しいプロンプトに失敗したりする安価なモデルは、最初に成功する高価なモデルよりも実際にはコストが高くなる可能性があります。出力の長さも重要です。出力には、すべてのモデルで入力の 2.5 ~ 5 倍の料金が請求されるため、冗長な安価なモデルは簡潔な高価なモデルに負ける可能性があります。ほとんどのチームが落ち着くパターンは次のとおりです。 階層化: ルーチン、大量のトラフィックを安価なモデル (Grok Fast、Gemini Flash、DeepSeek) にルーティングし、本当に難しいリクエストのみをフラッグシップにエスカレーションします。通話の 20% をプレミアム モデルに送信しても、混合コストは安いほうの端近くに抑えられます。
モデルが選択されると、次の 3 つのことが大きく影響します。 出力キャップ (セット max_tokens — 出力は高価な半分です)、 プロンプトキャッシュ (システム プロンプトを繰り返すと、OpenAI、Anthropic、Grok、DeepSeek では大幅な割引料金で請求されます)、および ルーティング (安いものを優先し、不確実性がある場合はエスカレートします)。それぞれが他のものと複合します。節約をモデル化する プロンプトキャッシュ計算ツール そして モデルルーティング計算機.
あなたのトークンは私たちのものではないため、出力が多いトラフィックや入力が多いトラフィックではランキングが入れ替わる可能性があります。実際の入出力の長さとボリュームを 最安の LLM API ランカー — すべてのモデルをソートします あなたの 数字 — または AI API コスト計算ツール。何か具体的なものを構築しますか?を使用します。 AI アプリのコスト見積りツール、AI をサブスクリプションで再販する場合、 AIラッパー価格計算ツール 価格が実際に API コストをクリアしているかどうかを示します。プロバイダーごとのガイド: グロク, OpenAI, クロード, ジェミニ, ディープシーク.
最安の LLM API ランカーを開く → ・ OpenAI vs クロード vs ジェミニ →
参考価格 (2026 年 6 月)、公開価格ページとプロバイダーの比較から収集。モデル名と料金は頻繁に変更されるため、予算を立てる前に確認してください。どのプロバイダとも提携していません。