Comment fonctionne cette calculatrice
Le Calculateur de coût de l'outil de recherche Web LLM estime le supplémentaire facture mensuelle que l'outil de recherche Web d'un modèle ajoute en plus de vos coûts normaux de jetons. Vous entrez votre demandes par mois, le nombre moyen de recherches par requête, et le prix du fournisseur pour 1 000 recherches, et il les multiplie pour trouver le total de vos frais de recherche. Il rend alors compte du jetons de résultat supplémentaires par recherche — les extraits récupérés et réinjectés dans le modèle — au prix de votre taux d'entrée par 1 million de jetons. Les deux principaux facteurs de coûts sont le volume de recherche (requêtes multipliées par les recherches) et le nombre de jetons de résultat injectés par chaque recherche.
C’est important car les frais de recherche et les tokens injectés sont facturés séparément à partir de votre invite de base, ils gonflent donc discrètement les dépenses. Si les coûts sont élevés, le levier le plus direct consiste à réduire recherches par requête - mettez en cache ou réutilisez les résultats et réduisez le nombre de résultats que vous extrayez, car chacun ajoute à la fois des frais de recherche et des jetons d'entrée à chaque appel.
Questions fréquemment posées
Combien coûte l'outil de recherche Web LLM ?
Les fournisseurs facturent l’outil de recherche intégré par recherche – généralement environ 10 $ pour 1 000 recherches (environ 0,01 $ chacune) – et cela s’ajoute aux jetons. Une requête qui déclenche deux recherches paie deux frais d'outil plus les jetons pour le résultat des recherches, ce qui représente souvent le coût le plus élevé.
Pourquoi les jetons de résultat constituent-ils la vraie dépense ?
Chaque recherche réinjecte des extraits ou des pages récupérés dans le contexte, et vous payez le prix du jeton d'entrée pour les traiter à chaque fois. À quelques milliers de jetons par recherche sur de nombreuses requêtes, ce coût de jeton dépasse souvent les frais par outil de recherche lui-même. Limiter les recherches par requête et couper le contenu renvoyé est le principal levier.