—
nessuna memorizzazione nella cache/mese—con memorizzazione nella cache/mese
—salvato mediante memorizzazione nella cache
—della finestra di contesto utilizzata
Costo per sessione quando colleghi più strumenti
Stessi turni per sessione e stessi prezzi di cui sopra: cambia solo il conteggio degli strumenti. Questo è il modo in cui gli agenti che collegano cinque o sei server MCP per comodità accumulano tranquillamente un conto che nessuno ha pagato.
| Strumenti collegati | Token dello schema | % del contesto | Costo/sessione, nessuna cache | Costo/sessione, memorizzato nella cache |
|---|
Da dove provengono i numeri sopra
Il primo turno di una sessione paga sempre l'intero prezzo di input: non c'è ancora nulla da leggere dalla cache. Ogni turno successivo legge lo stesso blocco di schema dalla cache, alla tariffa scontata, purché non cambi nulla nell'elenco degli strumenti o nel prompt precedente.
Come si collega alle altre linee di costo MCP e al contesto
Questa pagina prevede la tassa ricorrente sui token per la connessione degli strumenti MCP: non è quanto costa gestire il server dietro di essi. Prezzo quel lato, hosting, costruzione e manutenzione, sul Calcolatore dei costi del server MCP. Se gli schemi degli strumenti sono solo una parte di ciò che affolla la tua finestra di contesto, il file calcolatore dei costi della finestra di contesto valuta l'intera immagine, inclusi i documenti recuperati e la cronologia delle conversazioni. I calcoli di memorizzazione nella cache utilizzati qui (una lettura a prezzo intero, quindi letture scontate per il resto della sessione) sono lo stesso meccanismo alla base del calcolatore rapido del risparmio di memorizzazione nella cache, vale la pena verificare se si memorizza nella cache qualcosa di più delle semplici definizioni degli strumenti. E se gli schemi degli strumenti si trovano all'interno di un prompt di sistema fisso più ampio, il file calcolatore dei costi tempestivi del sistema prezzi dell'intero preambolo, strumenti inclusi, come un'unica tassa per richiesta.
Calcolatore dei costi del server MCPCalcolatore dei costi della finestra di contestoRisparmio immediato nella cacheCalcolatore dei costi dei prompt di sistema
Come funziona questa calcolatrice
IL Calcolatore del costo del token dello schema dello strumento MCP moltiplica la tua connessione conteggio degli utensili dal token medi per schema di strumento per ottenere il peso simbolico nel contesto prima ancora che inizi una conversazione, dividilo per il tuo dimensione della finestra di contesto per la percentuale sorprendente del contesto. Senza memorizzazione nella cache, il blocco viene inviato nuovamente e fatturato per intero prezzo di input a ogni turno di una sessione, quindi il costo mensile non memorizzato nella cache è pari a token dello schema × turni × sessioni × 30 × prezzo di input. Con la memorizzazione nella cache immediata, solo il primo turno di ciascuna sessione paga il prezzo intero; ogni turno successivo legge lo stesso blocco dalla cache al prezzo solitamente molto più economico prezzo di lettura della cache, quindi la formula diventa una lettura a prezzo intero più turni meno una lettura del prezzo cache, moltiplicata per sessioni e giorni.
Il risultato dipende principalmente dal numero di strumenti collegati e dalla durata delle sessioni. Una sessione con più turni ammortizza il primo turno costoso rispetto a letture memorizzate nella cache più economiche, motivo per cui la percentuale di risparmio nella memorizzazione nella cache aumenta all'aumentare dei turni per sessione e perché una sessione a turno singolo non ottiene alcun vantaggio dalla memorizzazione nella cache: non c'è alcuna lettura ripetuta da scontare. Il conteggio degli strumenti e la dimensione media dello schema guidano altrettanto fortemente il lato non memorizzato nella cache e guidano le statistiche consumate dal contesto indipendentemente dalla memorizzazione nella cache, perché un blocco di schema memorizzato nella cache ma ancora presente occupa ancora il contesto che il modello deve leggere ad ogni turno. Le cifre qui riportate sono un modello trasparente basato sulla dimensione media dello schema di circa 1.000 token segnalata dalla comunità, non una misurazione di alcuna distribuzione specifica: la dimensione reale dello schema varia in base a quanto sono dettagliate le descrizioni dei parametri di ciascuno strumento.