—com cache / mês
—salvo pelo cache
—da janela de contexto usada
Custo por sessão à medida que você conecta mais ferramentas
Os mesmos turnos por sessão e preços acima – apenas a contagem de ferramentas muda. É assim que os agentes que conectam cinco ou seis servidores MCP por conveniência acumulam silenciosamente uma conta sem preço.
| Ferramentas conectadas | Tokens de esquema | % de contexto | Custo/sessão, sem cache | Custo/sessão, em cache |
|---|
De onde vêm os números acima
O primeiro turno de uma sessão sempre paga o preço total de entrada — ainda não há nada para ler no cache. Cada turno seguinte lê o bloco de esquema idêntico do cache, com taxa de desconto, desde que nada na lista de ferramentas ou no prompt anterior seja alterado.
Como isso se conecta às outras linhas de custo de contexto e do MCP
Esta página cobra a taxa de token recorrente de ter ferramentas MCP conectadas – não é o que custa para operar o servidor por trás delas. Avalie esse lado, hospedagem, construção e manutenção, no Calculadora de custos do servidor MCP. Se os esquemas de ferramentas são apenas parte do que está lotando sua janela de contexto, o calculadora de custos da janela de contexto avalia a imagem completa, incluindo documentos recuperados e histórico de conversas. A matemática de cache usada aqui – uma leitura pelo preço integral e depois leituras com desconto para o resto da sessão – é o mesmo mecanismo por trás do calculadora de economia de cache imediata, vale a pena verificar se você armazena em cache mais do que apenas definições de ferramentas. E se seus esquemas de ferramentas estiverem dentro de um prompt de sistema fixo maior, o calculadora de custos imediata do sistema preços de todo o preâmbulo, incluindo ferramentas, como um imposto único por solicitação.
Calculadora de custos do servidor MCPCalculadora de custos da janela de contextoEconomia imediata de cacheCalculadora de custos de prompt do sistema
Como funciona esta calculadora
O Calculadora de custo de token de esquema de ferramenta MCP multiplica seu conectado contagem de ferramentas pelo tokens médios por esquema de ferramenta para obter o peso do token no contexto antes mesmo de uma conversa começar - divida isso pelo seu tamanho da janela de contexto para a porcentagem impressionante de contexto. Sem armazenamento em cache, esse bloco é reenviado e cobrado integralmente preço de entrada em cada turno de uma sessão, portanto, o custo mensal sem cache é tokens de esquema × turnos × sessões × 30 × preço de entrada. Com o cache imediato, apenas o primeiro turno de cada sessão paga o preço total; cada turno depois disso lê o bloco idêntico do cache pelo preço geralmente muito mais barato preço de leitura de cache, então a fórmula se torna uma leitura de preço total mais leituras de preço de cache menos uma, multiplicadas por sessões e dias.
O resultado depende principalmente de quantas ferramentas estão conectadas e da duração das sessões. Uma sessão com mais turnos amortiza o primeiro turno caro em relação a leituras em cache mais baratas, e é por isso que a porcentagem de economia de cache aumenta à medida que os turnos por sessão aumentam, e por que uma sessão de turno único não obtém nenhum benefício do armazenamento em cache - não há nenhuma leitura repetida para descontar. A contagem de ferramentas e o tamanho médio do esquema orientam o lado não armazenado em cache com a mesma força e orientam a estatística consumida pelo contexto, independentemente do armazenamento em cache, porque um bloco de esquema armazenado em cache, mas ainda presente, ainda ocupa o contexto que o modelo precisa ler a cada turno. Os números aqui são um modelo transparente construído com base no tamanho médio do esquema de aproximadamente 1.000 tokens relatado pela comunidade, e não uma medida de qualquer implantação específica - o tamanho real do esquema varia de acordo com o quão detalhadas são as descrições dos parâmetros de cada ferramenta.