プロバイダー
カテゴリ

0 モデルの比較 · 列ヘッダーをクリックして並べ替えます

モデル ▲▼ プロバイダー ▲▼ 入力 $/1M ▲▼ 出力 $/1M ▲▼ 3:1 ブレンド ▲▼ コンテクスト ▲▼ あなたの $/月 ▲▼
⚠️価格はおおよその参考値であり、最終更新日 2026-07、頻繁に変更されます。ユーロ/ポンドは簡単に比較できるよう、おおよその固定為替レートで表示されます。コミットする前に、必ずプロバイダー独自の料金ページで確認してください。ほぼすべてのプロバイダーで、出力トークンのコストは入力よりも高くなります。ホストされるオープンウェイト モデル (Llama、Qwen、DeepSeek、Mixtral) はホストによって異なります。最も安い価格≠最高の品質。コストとタスクの精度を比較検討します。

AI の公正な価格比較に 2 つの数字が必要な理由

オンラインで見つかるほぼすべての「AI モデルの価格」表は、入力価格によって並べ替えられています。これは、入力価格のほうが小さくて印刷しやすい番号であるためです。ただし、実際のアプリケーションには課金されます 両方 出力トークンの価格は通常、入力の 2 ~ 6 倍になります。長い文書を読んで短い回答を書く検索アプリや要約アプリは、大量の入力を必要とします。長い完了を生成するチャットボット、エージェント、またはコード ジェネレーターは出力が多くなります。同じ 2 つのモデルが、純粋にトラフィックがどちらに傾いているかに基づいて、ランキングの順位を入れ替えることができます。この表が入力と出力を別々に示しているのはそのためです。 3:1 ベースラインをブレンド (出力トークンあたり 3 つの入力トークンという現実世界の一般的な比率) を使用して簡単に同一条件で並べ替えることができ、独自のボリュームを入力して実際に支払う請求額を計算できます。

表の見方

検索ボックスに入力してモデルまたはプロバイダーにジャンプするか、プロバイダーとカテゴリ チップをクリックしてフィールド (フラッグシップ、ミッド、バジェット、推論、エンベディング、ビジョン、またはオープンウェイト) を絞り込みます。列ヘッダーをクリックすると昇順に並べ替えられ、もう一度クリックすると逆順に並べ替えられます。の 月額料金 列は上部の入力ボリュームと出力ボリュームから即座に再計算されるため、すべてのモデルに対して実際のワークロードのサイズを一度に設定できます。コンテキストは数千のトークン (K) で表示されます。1000K のコンテキスト ウィンドウは 100 万のトークンを意味します。

フロンティアの品質が安くなっている

高級モデルと低価格モデルの間の差は劇的に縮まりました。 2026 年には、フロンティア クラスのオープンウェイト モデル (Llama 4、Qwen 3、DeepSeek V4) を GPT-5.5 や Claude Opus の数分の 1 のコストで実行できるようになり、多くの運用タスク (分類、抽出、日常的なチャット) では、品質の違いがエンド ユーザーには見えなくなります。 Together、Fireworks、DeepInfra、Groq、Novita などのホストされた再販業者は同じ重量で競合するため、同じモデルがわずかに異なる価格で何度も登場する可能性があります。正しい行動は、「あらゆる場所で最高のモデルを使用する」ことはめったにありません。 難易度別ルート、安価なモデルに大部分を処理させ、フロンティア モデルは少数の通話のために予約されています。

モデル価格を 3 レバー下回る

モデルを選択すると、3 つのメカニズムによって料金がさらに削減されます。 即時キャッシュ 繰り返されるシステム プロンプトとコンテキストを通常の入力レートの一部で請求します。 プロンプトキャッシュ節約計算ツール. バッチ API 待機できるジョブについては約 50% オフになります。を参照してください。 バッチ API 節約計算ツール。そして、ルーチン呼び出しをより小さなモデルにルーティングすることが、多くの場合、すべての中で最大の手段となります。 AIモデルルーターのコスト計算ツール.

関連ツールとガイド

最安の LLM API ファインダー · LLM トークンコスト計算ツール · OpenAI vs Claude vs Gemini の価格設定 · ブレンド LLM 価格計算ツール · AIモデルルーターのコスト計算ツール · すべての AI API