学ぶ — API コストを理解して削減する

AI と API の価格設定に関するわかりやすい英語のガイド。専門用語は一切使わず、コストが実際にどのように機能するかだけを、無料の計算ツールに関連付けて説明します。

> 学ぶ

トークン、コンテキスト ウィンドウ、リクエストごとの料金、送信など、価格設定がわかりにくいため、AI と API の請求は制御不能になります。これらのガイドでは、それが実際にどのように機能するかを分かりやすく説明しており、各ガイドは無料の計算機にリンクしているので、独自の数値を入力できます。

ガイド

LLM API の価格設定の仕組み

トークン、入力と出力、コンテキスト ウィンドウ — 同じタスクのコストが、あるモデルでは別のモデルの 50 倍になる理由。

LLM API の請求を削減する方法

実際にコストを削減する 7 つの手段: キャッシュ、ルーティング、バッチ処理、RAG、安価なモデルなど。

トークンとリクエストの説明

トークンとは実際には何なのか、API リクエストとの違い、構築前に両方を見積もる方法。

人気の電卓

LLM トークンのコスト

任意のモデルのプロンプトと完了の正確なコスト。

即時キャッシュによる節約

システム プロンプトのキャッシュによって節約される量。

モデルルーティングの節約

簡単な通話は安価なモデルにルーティングし、難しい通話は強力なモデルにルーティングします。

セルフホストと API

独自の GPU を実行する場合、トークンごとに支払うよりも優れています。

教育上の参考のみ — 価格は推定値です。各プロバイダーの料金ページで現在の料金を確認してください。