プロバイダーは入力トークンと出力トークンの価格を個別に設定します — そして、アウトプットには通常、インプットの 3 ~ 5 倍のコストがかかります。したがって、短いプロンプトと長い応答は、長いプロンプトと短い応答よりもコストが高くなる可能性があります。 2 つの番号を入力すると、モデル間の実際の通話あたりのコストが表示されます。
モデルごとの通話あたりのコスト
トークンの数は、すべてのモデルで、最も安いものから順にランク付けされます。価格は100万トークンあたりの料金です。
| モデル | 100 万ドルあたり | アウト $/100 万 | 料金/通話 |
|---|
トークンコストの仕組み
式は簡単です: コスト = (入力トークン ÷ 1,000,000 × 入力価格) + (出力トークン ÷ 1,000,000 × 出力価格)。 2 つの価格は意図的に異なります。テキストの生成 (出力) は、テキストの読み取り (入力) よりもコストが高く、通常は 3 ~ 5 倍です。そのため、通常、請求書の最大の要因となるのは、 キャッピング出力長、プロンプトをトリミングしません。大まかな目安としては、 1,000 トークン ≈ 750 英単語ただし、コードと他の言語ではトークン化の方法が異なるため、正確な数値についてはプロバイダーのトークナイザーを使用して測定してください。
次のステップ
1 回の電話ではなく、製品全体を見積りますか?を使用します。 AI API コスト計算ツール または AI アプリのコスト見積りツール。エージェントまたはチャットボットを構築しますか?試してみてください AIエージェントのコスト計算ツール または チャットボットのコスト計算ツール。呼び出しごとに同じコンテキストを再利用しますか? 即時キャッシュ そして バッチジョブ それぞれがさらにコストを削減します。