Costo totale di indicizzazione per dimensione del corpus
Stessa dimensione del blocco, prompt generali e condivisione dei costi generali come sopra, distribuiti su tutta la dimensione del corpus: ecco come un "corpus di test da $ 33" diventa un "corpus di produzione da $ 3.300". La colonna di destra mostra la stessa ottimizzazione per un modello di estrazione a livello di budget ($ 0,15 / $ 0,60 per 1 milione) per mostrare quanta parte del conto dipende dalla scelta del modello piuttosto che dalla dimensione del corpus.
| Dimensione del corpo | Pezzi | Costo di estrazione | Costo totale di indicizzazione | Al modello di livello budget |
|---|
La colonna del livello di budget riesegue lo stesso blocco matematico con un input di $ 0,15 / un output di $ 0,60 per 1 milione di token: un modello di estrazione più economico riduce il conto all'incirca in proporzione al calo dei prezzi, non alla dimensione del corpus.
Indicizzazione una tantum rispetto ai costi di query ricorrenti
L'indicizzazione avviene una volta per ogni versione del corpus. Il costo della query si verifica su ogni singola domanda, per sempre: GraphRAG aggiunge la riga seguente sopra di essa, non al suo posto.
| Costo | Quando viene pagato | Modellato da |
|---|---|---|
| Indicizzazione GraphRAG (estrazione entità/relazione) | Una volta per versione corpus: esegui nuovamente solo quando cambiano i documenti di origine | Questa calcolatrice |
| Query RAG standard (recupero + generazione) | Ricorrente: ogni domanda, ogni utente, per sempre | Calcolatore dei costi RAG |
| Query GraphRAG (attraversamento del grafico + generazione) | Ricorrente, uguale al costo standard delle query RAG, pagato in aggiunta all'indicizzazione | Calcolatore dei costi di RAG Chatbot |
Come si collega ad altri strumenti RAG
Questa pagina prezza solo il indicizzazione metà di GraphRAG: il pass LLM una tantum che trasforma i tuoi documenti in un grafico della conoscenza. Non sostituisce gli strumenti che prezzano tutto a valle di ciò. Una volta che il grafico esiste, ogni domanda contro di esso costa comunque il recupero più la generazione, come qualsiasi altro sistema RAG: prezzo quel lato ricorrente sul grafico Calcolatore dei costi RAG oppure, per un'interfaccia in stile chat con cronologia delle conversazioni, il Calcolatore dei costi di RAG Chatbot. Se stai ancora decidendo se un grafico della conoscenza sia l'architettura giusta o invece la messa a punto di un modello sul tuo corpus, RAG vs messa a punto espone quel compromesso. E poiché i vettori sottostanti, per gli incorporamenti di blocchi e i riepiloghi della comunità, hanno ancora bisogno di un posto dove vivere, controlla quanto costa l'archiviazione sul Calcolatore dei costi del database vettoriale.