正解ごとに安くなる
プレミアム/正しい
安い/正しい
損益分岐点の精度

ステッカーの価格と結果の価格

各モデルの価格は 2 つの方法で設定されています。1 つは呼び出しあたりの直接のコスト、もう 1 つは再試行にかかる費用を精度で割った後の実効コストです。 「再試行」列は精度を 1 つ上回るもので、1 つの良い答えを得るまでに平均何回試行が必要かです。正解ごとに最も安い行が強調表示されます。必ずしも最も安いステッカーではありません。

モデル$/通話正確さ試行/正解$/正解毎月

安価なモデルにはどの程度の精度が必要か

プレミアム モデルの正解あたりの固定コストに対して、安価なモデルのさまざまな精度における実効コストが低くなります。それらが交わる行は損益分岐点の精度です。それより上では安価なモデルが勝ち、それより下では再試行によりより高価なモデルになります。

精度が低いより安い $/正しいプレミアム $/正解勝者

お金がかかる割引

すべてのモデル選択ダッシュボードは 100 万トークンあたりの価格で並べ替えられており、そのすべてが間違った質問に答えています。請求書に請求されるのは通話の料金ではなく、実際に使用できる通話の料金です。タスクの正解と不正解が判明した瞬間、これら 2 つの数字はバラバラになります。呼び出しごとに 30% 安いが、精度が 10 ポイント低いモデルは、30% 安いわけではありません。再試行するか間違いを破棄すると、使用可能な結果ごとにさらに多くの試行を購入することになり、算術演算によりランキングが完全に逆転する可能性があります。修正は 1 つの除算です。試行のコストを取得し、それを試行が成功する確率で割って、それに基づいてモデルを比較します。この計算機が出力する損益分岐点は、単一の数値で決定されます。つまり、再試行で支払う税金ではなく、より安価なモデルが実際の割引になる前にクリアする必要がある精度です。これは、正しいか間違っているかを区別し、単純に失敗を再実行できることを前提としています。これは、テスト スイート、検証者、または人間によるレビューがある場合にまさに当てはまります。間違った答えが検出されずに出荷される場合、安価なモデルはさらに悪いです。なぜなら、下流で間違っているというコストも支払うことになるからです。最初に 1 回の通話の料金を設定します。 トークンコスト計算ツール、生のモデルの価格を比較します。 モデル比較ページコールをエージェントに連鎖させている場合は、フルタスク トークンの書き込みサイズを次のように設定します。 AIエージェントのコスト計算ツール.

プロジェクトをホストします。DigitalOcean — $200 無料 ↗ホスティンガー VPS
トークンコスト価格/性能A/B テストのコストAI エージェントのコストモデルの比較