Il costo di un chatbot RAG è dominato dal contesto recuperato che inserisci nel prompt, non la domanda. Ogni query = incorporamento + ricerca vettore + una chiamata LLM che trasporta i tuoi blocchi. Inserisci il tuo utilizzo per visualizzare la fattura mensile.

al mese
per query
all'anno
domande/mese

Ripartizione dei costi per query

Componente$/interrogazione% del totale
⚠️ Stime di riferimento (luglio 2026). L'incorporamento di token da ~$0,02/1 milione e una query vettoriale sono minuscoli accanto alla chiamata LLM che trasporta il contesto recuperato. I prezzi variano in base al modello e al fornitore: digita le tue tariffe reali. L'archiviazione DB vettoriale viene fatturata separatamente (vedere il calcolatore dei costi del database vettoriale). · Segnala prezzo obsoleto →

Perché il contesto recuperato è il driver di costo

Le persone presumono che la domanda incida sui costi RAG. Non è così pezzi recuperati incolli nel prompt do. Estrai 8 blocchi da 500 token e ogni query trasporta 4.000 token di input prima che il modello scriva una parola. Ecco perché recuperando meno pezzi, più piccoli e migliori batte qualsiasi altra ottimizzazione, seguita da memorizzazione nella cache il prompt del sistema statico. Dimensionare l'archivio vettoriale con il file calcolatore dei costi del database vettorialee confronta i modelli su Calcolatore dei costi dell'API AI. Per un bot non RAG, vedere il file calcolatore dei costi del chatbot.

Ospita il tuo progetto:DigitalOcean: $ 200 gratis ↗Hostinger VPS
Calcolatore del throughput fornito (PTU).Calcolatore dei costi di conversazione multi-turnoCalcolatore del markup di AI GatewayCalcolatore dei prezzi per posto e utilizzoStima dei costi delle app AI