2026 年 8 月 12 日公開 · 参照番号、予算編成前に確認してください
同じコンテンツ モデレーション ジョブ (コンテキストの 150 個の入力トークン、もう一方の端からの 5 トークンのラベル) を 9 つの異なる「格安」モデルで実行すると、月額料金は 59.50 ドルから 1,750 ドルの範囲になります。同じジョブ、同じ量、同じ出力。スプレッドは 29 倍で、どのベンダーのドキュメントを読んでいるかに応じて、これら 9 つのモデルのすべてが「予算オプション」として売り込まれます。
当社の追跡された価格表 (387 モデル) から抜粋: すべてのモデルの価格は、プロバイダーが現在大量の低遅延タスク (分類、抽出、モデレーション、ルーティング) 向けに販売している入力トークンの価格が 1/100 万ドル未満です。毎月 1,000 万件の呼び出し、それぞれ 150 の入力トークンと 5 つの出力トークン、つまり合計 150 億の入力トークンと 5,000 万の出力トークンになります。
| モデル | プロバイダー | 入力/1M | 出力/1M | 毎月 (1,000 万通話) |
|---|---|---|---|---|
| ノバマイクロ | アマゾン | $0.035 | $0.14 | $59.50 |
| 大臣3B | ミストラル | $0.040 | $0.04 | $62.00 |
| コマンドR7B | コヒア | $0.0375 | $0.15 | $63.75 |
| ジェミニ 3.1 フラッシュライト | グーグル | $0.050 | $0.20 | $85.00 |
| GPT-5ナノ | OpenAI | $0.100 | $0.40 | $170.00 |
| GPT-4.1ナノ | OpenAI | $0.100 | $0.40 | $170.00 |
| GPT-4oミニ | OpenAI | $0.150 | $0.60 | $255.00 |
| クロード俳句 3.5 | 人間的 | $0.800 | $4.00 | $1,400.00 |
| クロード俳句 4.5 | 人間的 | $1.000 | $5.00 | $1,750.00 |
| 追跡表、387 モデルの参考価格。実行例: 1000 万コール/月 × 150 入力 + 5 出力トークン。で独自のボリュームの価格を設定します 分類コスト計算ツール. | ||||
Nova Micro、Ministral 3B、Command R7B は相互に 7% 以内に位置しており、このリストではどれも有名な企業ではありません。 2 つの OpenAI nano SKU は、Nova Micro のほぼ 3 倍に相当します。 GPT-4o mini — おそらくブランド認知だけで最も多くのユーザーにリーチされている「安価な」モデル — はすでに Nova Micro の 4.3 倍です。また、Anthropic の低価格帯として販売されている Claude の Haiku ラインの価格は、この表の他のチャット モデルよりも一部の中級チャット モデルに近いです。入力で Nova Micro の 29.4 倍、出力で 35.7 倍です。
どのプロバイダーも「月に 10 億件の通話を行うとどうなるか」に対する答えを必要としているため、どのプロバイダーも安価なモデルを出荷しています。しかし、安いというのは、市場に対するものではなく、各ベンダーの主力製品に対するものです。 Anthropic の主力商品と Haiku の差、および Amazon の主力商品と Nova-Micro の差は、どちらもそれぞれのカタログ内での実質的な割引であり、同じところから始まるわけではありません。 Nova Micro はクラウド プロバイダーによって構築され、クラウド プロバイダーはその基盤となるコンピューティングも販売しているため、モデルの価格は限界コストに近いものにすることができます。 Claude Haiku は、Sonnet と Opus の隣に位置するという価格設定の重力を受け継いでおり、主力製品自体が高価であるため、「主力製品の 10 倍安い」価格は依然として 1/100 万ドルとなっています。
これはいずれも、Haiku が分類ジョブにとって悪いモデルであることを意味するものではありません。多くの場合、Haiku のほうが正確であり、間違ったラベルのコストがトークンの違いよりも高い場合、精度にはお金を払う価値があります。つまり、「予算層」は市場に関する主張ではなく、ベンダー自身のラインナップに関する主張であり、価格設定ページや比較スレッドではこの 2 つが常に混同されています。
本当に大量で複雑性の低いタスク (スパム フィルタリング、インテント ルーティング、PII 検出、センチメント タグ付け) の場合は、既に API キーを持っているブランドではなく、Nova Micro、Ministral 3B、または Command R7B を最低価格として開始します。コミットする前に、ラベル付きデータに対して実際の精度チェックを実行します。 29 倍の価格差は、安価なモデルのエラー率が下流コストの削減を食いつぶさない場合にのみ良い取引となります (チケットのルートミス、モデレーション フラグの見逃し、人間によるレビューが必要な不適切な抽出)。特定のタスクの精度が GPT-4o mini または Haiku を下回らない場合、それがタスクの実際の価格になります。59.50 ドルではなく、デフォルトの 1,750 ドルでもありません。独自のトークンの組み合わせとボリュームの価格を設定します。 分類コスト計算ツール または コンテンツモデレーションコスト計算ツールで全ラインナップを比較してください。 最安の LLM API ページ.
方法論: 2026 年 8 月時点での追跡された価格表 (387 モデル) の価格。各プロバイダーが公開している 100 万トークンあたりのレートと一致します。実際の例では、運用システムからのテレメトリではなく、短い分類呼び出しに典型的な構築された 150 入力/5 出力のトークン比率を使用しています。予算を立てる前に、独自のワークロードのトークンの組み合わせと各プロバイダーの現在のレートを確認してください。