HomeBlog › DeepSeek R1 対 O1 対 O3 の推論コスト

DeepSeek R1 vs o1 vs o3: 推論プレミアムは均等に縮小しませんでした

2026 年 8 月 10 日公開 · 参照番号、予算編成前に確認してください

OpenAI の o1 を介して同じ思考連鎖ワークロードを実行すると、DeepSeek R1 のコストの 27 倍のコストがかかります。代わりに o3 経由で実行すると、同じプロバイダー、同じ推論層、同じ「答える前に考える」動作が使用され、そのギャップは 3.6 倍に減少します。それは四捨五入の差ではありません。つまり、「推論モデルのコストは無差別ウェイトモデルと比べていくらになるのか」という質問に対する答えは 1 つではありません。 OpenAI 独自の推論ラインナップは、カタログの外を見る前から 7.5 倍の範囲に及ぶため、OpenAI が出荷するモデルごとに異なる答えがあります。

ラインナップは横並びに

価格表から直接取得 (387 モデルが追跡され、プロバイダーのドキュメントに対して最後に更新): OpenAI の 4 つの現在の推論 SKU に加え、DeepSeek の R1 とその蒸留されたバリアント (100 万トークンあたり)。

モデルプロバイダー入力/1M出力/1Mvs DeepSeek R1 (ブレンド)
o1OpenAI$15.00$60.0027.4×
o3OpenAI$2.00$8.003.7×
o4-mini / o3-mini / o1-miniOpenAI$1.10$4.402.0×
Grok 4 の推論xAI$3.00$15.006.2×
ディープシーク R1ディープシーク$0.55$2.191.0×
DeepSeek R1 蒸留ラマ 70Bディープシーク$0.23$0.690.35×
DeepSeek R1 蒸留クウェン 32Bディープシーク$0.18$0.180.11×
Reference pricing from our tracked table, 387 models. "vs DeepSeek R1" uses a blended 3:8 input:output token ratio matching the worked example below.独自の比率を実行します。 推論トークンのコスト計算ツール.

その曲線の形状に注目してください。これは高価なものから安価なものへの直線ではありません。o1 から o3 だけでも、競合他社が関与していない OpenAI 独自のカタログ内で生産価格が 87% 削減されます。その後、抽出された DeepSeek バリアントは、ベンチマークが正直に示す実際の機能コストで、完全な R1 さえもさらに 3 ~ 5 倍下回ります。 1 つの表に 4 つの論点があり、「理屈の税」が何を意味するかについて、まったく異なる 4 つの話があります。

うまくいった例: 毎月 10,000 件のリクエスト

応答する前に理由を判断するサポートトリアージエージェント: チケットごとにコンテキストの入力トークンが 1,500、出力として請求される非表示の思考連鎖トークンをカウントすると出力トークンが 4,000 になります。毎月 10,000 チケットは、1,500 万の入力トークンと 4,000 万の出力トークンに相当し、各モデルに対して実行されます。

モデル投入コスト出力コスト月々の合計
o1$225.00$2,400.00$2,625.00
Grok 4 の推論$45.00$600.00$645.00
o3$30.00$320.00$350.00
o4-mini$16.50$176.00$192.50
ディープシーク R1$8.25$87.60$95.85
10,000 チケット/月 × 1,500 イン/4,000 アウト トークン。ワークロードの例 — 独自のミックスに価格を設定します 推論トークンのコスト計算ツール.

理論上、両方のモデルで同じことを要求するワークロードの場合、o1 では月額 2,625 ドルであるのに対し、DeepSeek R1 では月額 95.85 ドルです。代わりに o1 を o3 に交換すると、OpenAI の請求額だけでも、DeepSeek が比較対象に入る前に、2,625 ドルから 350 ドルに 87% 下がります。現在出回っている「推理税」のホラーストーリーのほとんどは、実際には、それが唯一のフロンティア推理オプションだった頃から引き継がれたo1の価格設定です。 OpenAI 自身のラインナップの中でも、それはもうありません。

なぜギャップはどこでも同じではないのか

o1 は、推論による推論が希少でほとんど証明されていないときに価格設定されました。推論の有無にかかわらず、OpenAI のカタログ全体のトップ近くに出荷されました。 o3 と o4-mini は、競争 (DeepSeek R1 が 1 月に発売され、Grok と Gemini の推論層が続いた) の後に登場し、フロンティア ラボは、すでにフラッグシップ チャットの価格を擁護することを強いられていたのと同じ方法で推論の価格を守ることを余儀なくされました。特にミニ層の推論モデルは現在、推論を行わない中間層の価格設定に十分近い水準にあり、「推論モデルを使用するべきか」は多くのワークロードにとって主にコストの問題ではなくなり、代わりにレイテンシと思考連鎖のトークン予算の問題となっています。

収束していないのは、最上位にある 1 ドルあたりの品質です。 o1 と o3 は互換性がありません。o3 は新しい、一般に強力なモデルで、価格は数分の一であり、簡単にアップグレードできます。 DeepSeek R1 は別のトレードオフです。オープンウェイト、自己ホスト可能、同様の価格設定ですが、これまでに引用されたほとんどのサードパーティの評価では、厳密な推論タスクに関して o3 よりも有意にベンチマークが行われています。 o1 に対する 27 倍という数字は実際のものであり、知る価値があります。これは、「R1 は o3 の代わりに 27 倍安くなる」という主張と同じではありません。その比較は 3.7 倍に近く、これは機能のトレードオフであり、無料アップグレードではありません。

決定ルール

o1 の価格に固執しないでください。o1 は市場で最も高価な推論 SKU であり、その価格設定をチームが価格設定するべきではなくなりつつあります。現実的な OpenAI ベースラインとして o3 または o4-mini を基準にして、DeepSeek R1 の残りの 2 ~ 4 倍の割引が自己ホスティングまたはサードパーティ推論のオーバーヘッドに見合う価値があるかどうか、および抽出されたバリアントの機能低下がタスクにとって許容できるかどうかを判断します。実際のトークンの組み合わせに価格を設定します。チャット ワークロードとは異なり、ワークロードが出力を偏らせると推論するため、API コスト スタックの他のほとんどの場所よりも、ここでの混合比率が重要になります。数字を実行してください 推論トークンのコスト計算ツール または 推論トークンオーバーラン計算ツール 隠された思考連鎖トークンが予測できない部分である場合は、次のことを確認してください。 推論トークン税 同じプロンプトで o3 を非推論 GPT-4.1 と比較する方法について説明します。

方法論: 2026 年 8 月時点の追跡価格表 (387 モデル) の価格で、各プロバイダーが公開している 100 万トークンあたりのレートと一致します。この例では、運用システムからのテレメトリではなく、構築された 1,500 入力/4,000 出力のトークン比率を使用してスケーリングを示しています。予算を立てる前に、独自のワークロードのトークンの組み合わせと各プロバイダーの現在のレートを確認してください。