家 > 学ぶ
トークン、コンテキスト ウィンドウ、リクエストごとの料金、送信など、価格設定がわかりにくいため、AI と API の請求は制御不能になります。これらのガイドでは、それが実際にどのように機能するかを分かりやすく説明しており、各ガイドは無料の計算機にリンクしているので、独自の数値を入力できます。
ガイド
LLM API の価格設定の仕組み
トークン、入力と出力、コンテキスト ウィンドウ — 同じタスクのコストが、あるモデルでは別のモデルの 50 倍になる理由。
LLM API の請求を削減する方法
実際にコストを削減する 7 つの手段: キャッシュ、ルーティング、バッチ処理、RAG、安価なモデルなど。
トークンとリクエストの説明
トークンとは実際には何なのか、API リクエストとの違い、構築前に両方を見積もる方法。
人気の電卓
LLM トークンのコスト
任意のモデルのプロンプトと完了の正確なコスト。
即時キャッシュによる節約
システム プロンプトのキャッシュによって節約される量。
モデルルーティングの節約
簡単な通話は安価なモデルにルーティングし、難しい通話は強力なモデルにルーティングします。
セルフホストと API
独自の GPU を実行する場合、トークンごとに支払うよりも優れています。
教育上の参考のみ — 価格は推定値です。各プロバイダーの料金ページで現在の料金を確認してください。