違いはどこから来るのか
どちらのモデルでも入力と出力の価格は別々に設定されています。通常、出力のほうが価格が高く、ワークロードによって多くの差異が発生するため、出力のほうが差を生み出します。
| 側 | 現在 | 新しい | 変化 |
|---|
紙幣の変更は賞品のサイズです
モデルの切り替えは AI 法案の最大の要因の 1 つですが、通常、決定は「100 万トークン当たりのコストはこちらの方が安い」という見出しの数字に基づいて行われますが、実際のワークロードに耐えられるものではありません。請求書は、アプリが実際にモデルを使用する方法によって重み付けされた入力価格と出力価格を組み合わせたもので、お金が発生するのは出力です。通常、入力レートの 3 ~ 5 倍であり、エージェント、チャットボット、コード ジェネレーターがその多くを生成します。入力では近くに見える 2 つのモデルは、出力がカウントされると 2 倍離れている可能性があります。この計算機は、実際の月次の入力量と出力量に基づいて両方のモデルの価格を計算し、その差を金額、パーセンテージ、および年間の数値、つまり実際にプレイしている賭け金として報告します。
その数字を見ると会話が変わります。年間 8% を節約する移行では、エンジニアリング時間、回帰テスト、および微妙な品質低下のリスクが正当化されることはほとんどありません。請求額を半分にするものは真剣に評価する価値があります。そして、矢印は両方の方向を指しています。つまり、より高機能でより高価なモデルへの移行は、ボリュームで管理可能な金額しか追加されないことがわかっている場合、正当化するのが簡単です。これを使用して、最初に賞品のサイズを決定し、それからそれを追いかける価値があるかどうかを判断し、それを 最も安価な LLM API ツール フィールド全体をスキャンし、 推論トークン計算機 新しいモデルが答える前に考える場合。
使い方
1. 現在使用しているモデルと検討しているモデルを選択してください。
2. 毎月の入力トークン (送信するすべてのもの) と出力トークン (モデルが書き込むすべてのもの) を百万単位で入力します。
3. 見出しを読んでください: 緑色はスイッチのコストが節約されることを意味し、オレンジ色はコストがかかることを意味します。
4. 内訳表を確認して、入力と出力のどちらが違いを生み出しているかを確認してください。
よくある間違い
投入価格のみで比較します。 ほとんどのアプリにとって、出力は高価で大量の側です。安価な入力と大量の出力を備えたモデルは、高価な選択肢になる可能性があります。 トークン数が等しいと仮定します。 新しいモデルで同じ品質を達成するためにより長いプロンプトが必要な場合、またはより多くの書き込みが必要な場合、実際のコストはこのストレート スワップで示されるよりも高くなります。 移行コストは無視します。 再テスト、迅速な調整、監視にはエンジニアリング時間がかかります。年間の節約額と比較検討してください。 割引を忘れる。 即時キャッシュとバッチ価格設定によりランキングが変わる可能性があります。両方の側面を一貫してモデル化します。
見積もりのみ。モデルの価格は頻繁に変更されます。移行する前に、現在の 100 万あたりの入力および出力レートを確認してください。