静的な RAG 相当コストと実際のアンサー エンジン コストの比較
同じ LLM 入力と出力、ライブ Web 検索 API 料金を差し引いたもの。これは、インデックスが事前に作成されたライブ検索のない静的 RAG システムとまったく同じクエリにかかるコストです。その差額がライブ検索プレミアムです。
| 原価ベース | コスト/クエリ | 月額費用 |
|---|---|---|
| 静的 RAG 相当 (LLM 合成のみ、ライブ検索手数料なし) | — | — |
| 実際のアンサー エンジンのコスト (LLM 合成 + ライブ検索 API) | — | — |
取得したスニペットごとのコスト (上位 K)
他のすべては上記の値に保持され、クエリごとに LLM のコンテキストに詰め込まれる検索結果の数をスイープします。スニペットが多いほど、より根拠のある回答が得られる可能性がありますが、追加のスニペットはすべて、単一のクエリごとに追加の入力トークンとして課金されます。
| スニペット (上位 K) | 入力トークン/クエリ | コスト/クエリ | 月額費用 |
|---|
これが他のツールにどのように接続されるか
このページの価格は、 ライブ検索回答エンジン — Perplexity / You.com / Bing Copilot スタイルのパイプライン。LLM が質問を認識する前に、すべてのクエリがサードパーティの Web 検索 API にヒットします。これは、すでに所有しているコーパスを中心に構築されたシステムとは異なるアーキテクチャです。検索ステップが、自分でインデックスを付けたドキュメントに対するベクトル検索である場合、どのクエリに対してもライブ検索 API の料金はかかりません。 RAG コスト計算ツール 代わりに、または RAG チャットボットのコスト計算ツール 同じ静的コーパス上に履歴を備えた会話型インターフェイスの場合。単純なベクトル検索ではなく、ナレッジ グラフ アーキテクチャを特に評価している場合、 GraphRAG インデックス作成コスト計算ツール それを構築する 1 回限りの抽出パスの価格を設定します。ここでのすべてのクエリは、同じシステム プロンプトとオーバーヘッド トークンに対する入力トークンの全額を繰り返し支払うため、プロンプト キャッシュによってその定期的なコストが削減できるかどうかを確認してください。 プロンプトキャッシュ節約計算ツール。これは、自分の Web サイトやアプリに検索ボックスを追加することとも無関係であることに注意してください。それが必要な場合は、Algolia、Typesense、または Meilisearch を介して、自分のコンテンツに対するタイプミス耐性のある即時検索を利用できます。 サイト検索 API コスト計算ツール.