Le coût d'un chatbot RAG est dominé par le contexte récupéré que vous insérez dans l'invite, pas la question. Chaque requête = intégration + recherche de vecteur + un appel LLM transportant vos morceaux. Entrez votre consommation pour voir la facture mensuelle.

par mois
par requête
par année
requêtes/mois

Répartition des coûts par requête

Composant$ / requête% du total
⚠️ Estimations de référence (juillet 2026). L'intégration de jetons d'environ 0,02 $/1 M et une requête vectorielle sont minuscules à côté de l'appel LLM transportant le contexte récupéré. Les prix varient selon le modèle et le fournisseur – saisissez vos tarifs réels. Le stockage de la base de données vectorielle est facturé séparément (voir le calculateur de coût de la base de données vectorielle). · Signaler un prix obsolète →

Pourquoi le contexte récupéré est le facteur de coût

Les gens supposent que la question détermine le coût du RAG. Ce n'est pas le cas - le morceaux récupérés vous collez dans l'invite do. Extrayez 8 morceaux de 500 jetons et chaque requête contient 4 000 jetons d'entrée avant que le modèle n'écrive un mot. C'est pourquoi récupérer des morceaux moins nombreux, plus petits et de meilleure qualité bat toute autre optimisation, suivi de mise en cache l'invite système statique. Dimensionnez le magasin de vecteurs avec le calculateur de coût de base de données vectorielle, et comparer les modèles sur le Calculateur de coût de l'API IA. Pour un bot non-RAG, consultez le calculateur de coût de chatbot.

Hébergez votre projet :DigitalOcean — 200 $ gratuits ↗VPS Hostinger
Calculateur de débit provisionné (PTU)Calculateur de coût de conversation à plusieurs toursCalculateur de balisage AI GatewayCalculateur de prix de siège et d'utilisationEstimateur du coût des applications IA