最安/月
最安モデル
対プレミアムモデル
までに払いすぎます

各モデルを月額料金でランキング

同じ作業量、最初に安いもの。入力と出力は個別に価格設定されます。

モデル100 万ドルあたり100 万ドルあたりのアウト月額料金
⚠️お見積り。トークンごとの価格は参考値 (2026 年 6 月) であり、頻繁に変更されます。コミットする前にプロバイダーの価格ページで確認してください。ホストされるオープンウェイト モデル (Llama、Qwen、DeepSeek) はホストによって異なります。最も安い価格≠最高の品質。コストとタスクの精度を比較検討します。

出力トークントラップ

ほぼすべての「LLM 価格設定」テーブルは、入力価格によって並べ替えられます。これは、入力価格のほうが小さくてわかりやすい番号であるためです。ただし、実際のアプリケーションには課金されます 両方 出力トークンの価格は通常、入力の 2 ~ 6 倍になります。長い文書を読んで短い回答を書くサマライザーは、大量の入力を必要とします。長い完了を生成するチャットボットまたはコード ジェネレーターは、出力が多くなります。同じ 2 つのモデルが、純粋にトラフィックがどちらに傾いているかに基づいて、ランキングの順位を入れ替えることができます。そのため、単一のヘッドライン価格だけでは LLM API が最も安いかどうかを判断することはできません。それを判断できるのは、独自のインプットとアウトプットの比率だけです。

フロンティアの品質が安くなっている

高級モデルと低価格モデルの間の差は劇的に縮まりました。 2026 年には、フロンティア クラスのオープンウェイト モデル (Llama 4、Qwen、DeepSeek V4) を GPT-5.5 や Claude Opus 4.8 の数分の 1 のコストで実行できるようになり、多くの制作タスク (分類、抽出、日常的なチャット) では、品質の違いがエンド ユーザーには見えなくなります。 「あらゆる場所で最高のモデルを使用する」ことが正しい行動になることはめったにありません。それは 難易度別ルート: 安価なモデルが大部分を処理し、フロンティア モデルは少数の通話のために予約されています。この 1 つのパターンにより、ユーザーが気付かないうちに AI の料金が半分になることがよくあります。

モデル価格を 3 レバー下回る

モデルを選択すると、3 つのメカニズムによって料金がさらに削減されます。 即時キャッシュ 繰り返されるシステム プロンプトとコンテキストを通常の入力レートの一部で請求します。 プロンプトキャッシュ節約計算ツール. バッチ API 待機できるジョブについては約 50% オフになります。を参照してください。 バッチ API 節約計算ツール。そして、コンテキストのサイズを適切にして、モデルに必要のないトークンの送信を停止することが、最も低コストの最適化です。スタック全体を LLM トークンコスト計算ツール.

関連ツールとガイド

LLM トークンコスト計算ツール · OpenAI vs Claude vs Gemini の価格設定 · 即時キャッシュによる節約 · バッチ API の節約 · すべての AI API