Preços de gateway

sobrecarga de gateway / mês
total de gateway
marcação eficaz
despesas gerais / ano

Sobrecarga conforme você escala

Uma taxa fixa diminui em proporção à conta com o volume; uma margem percentual cresce junto com ela. Observe onde a sobrecarga ultrapassa o custo de execução do seu próprio proxy.

Solicitações mensaisCusto diretoTotal de gatewayDespesas gerais

A camada de conveniência tem um preço que varia com você

Um gateway LLM compra coisas reais – uma API em muitos provedores, fallback automático quando um modelo está inativo, cache, registro e limites de gastos centralizados – e cobra por eles como uma margem percentual sobre tokens, uma taxa por solicitação, uma taxa fixa mensal de plataforma ou uma combinação. A armadilha é que uma margem percentual é invisível quando você é pequeno e enorme quando você é grande: 5% em uma nota de US$ 200 é um erro de arredondamento, mas 5% em uma nota de US$ 40 mil é o salário anual de um engenheiro em tempo integral, gasto em um recurso que você poderia auto-hospedar com um proxy de código aberto. Esta calculadora separa o custo bruto do provedor do corte do gateway para que você possa ver a marcação efetiva e a sobrecarga anual em um só lugar e, em seguida, decidir rota por rota. Compare os preços brutos dos tokens no comparação de preços de modelos, recupere gastos com solicitações repetidas com cache de prompte modelar toda a conta no Calculadora de custos de pilha de API.

Hospede seu projeto:DigitalOcean – $ 200 grátis ↗VPS da Hostinger
Custo da base rochosaCusto de migração de modeloPlanejador de orçamento de APICusto da janela de contextoCusto do chatbot RAG