トレースあたりのスパンを増加させた場合のユニット モデルごとの請求

トレース量は同じですが、トレースの平均複雑さだけが変わります。これは、スパンごとの課金がトレースごとの課金を静かに上回る場所です。

スパン/トレースラングスミススタイルラングヒューズスタイルヘリコン式

ステッカー価格よりもユニットのモデルが重要です

すべての LLM 可観測性プラットフォームは、無料利用枠とユニットごとの料金を宣伝していますが、「ユニットごと」の意味はそれぞれで異なります。 LangSmith スタイルの価格設定では、トレース (1 回の完全なエージェントの実行 (内部ステップの数に関係なく)) が請求単位として扱われるため、複雑なマルチツール エージェントのトレース料金は 1 回の LLM 呼び出しと同じになります。 Langfuse スタイルの価格設定では、すべてのスパンとスコアを個別に請求します。同じトレース内の各 LLM 呼び出し、取得、ツール呼び出し、評価は独自の単位であるため、複雑さが直接請求額を倍増します。 Helicone スタイルの価格設定はリクエストごとに近く、論理的なトレースではなく API 呼び出しを追跡します。

実際の結果: 単純な 1 回通話のチャットボットを構築している場合、3 つのモデルはすべて同様の範囲内に収まります。トレースあたり平均 6 ~ 10 スパンの RAG パイプラインまたはマルチツール エージェントを構築している場合、同一のトラフィックに対するスパン単位の請求は、トレース単位の請求よりも数倍高くなる可能性があります。これは、プラットフォーム自体が高価であるためではなく、別のより詳細なものをカウントしているためです。ツールを選択する前に、見出しの月額料金を比較するのではなく、トレースごとの独自の平均スパンを測定し (ほとんどの SDK でこれが公開されています)、上の表を実行してください。

プロジェクトをホストします。DigitalOcean — $200 無料 ↗ホスティンガー VPS
AI エージェントのコスト計算ツールエージェント ループの予算計算ツール可観測性と監視コストRAG コスト計算ツール