HomeToolsLearn › Calculadora de custo de aluguel de nuvem GPU
por mês
$/GPU-hora
salvamento local versus sob demanda
sempre ligado (730h)

Cada GPU em seu horário e contagem

Custo mensal para as horas e contagem de GPU acima — sob demanda e local lado a lado.

GPUVRAM$/h sob demandaÀ vista $/hMensalmente (seu nível)
⚠️ Estimativa. As taxas de GPU são números de referência do mercado intermediário (julho de 2026) combinados com provedores como RunPod, Lambda, Vast.ai, CoreWeave e hiperescaladores – os preços reais variam por região, disponibilidade e compromisso. A capacidade local/comunitária pode ser recuperada a qualquer momento. Sempre confirme o preço ao vivo com seu provedor. · Informar preço desatualizado →

Uma GPU alugada cobra cada hora que é ligada

O que surpreende as equipes que mudam de APIs para suas próprias GPUs é que o medidor nunca para. Uma API por token não custa nada quando o tráfego está silencioso; um H100 alugado custa o mesmo, esteja saturado ou com 2% de utilização, porque você está pagando pela hora, não pelo trabalho. É por isso que a maior alavanca na sua conta não é a GPU que você escolhe – mas quantas horas você o mantém funcionando. Um H100 que você só precisa de oito horas por dia custa um terço de um que fica ligado 24 horas por dia. Esta calculadora deixa isso explícito: defina as horas reais, não o máximo teórico, e observe o movimento do número mensal. O menu suspenso de configuração rápida cobre os padrões comuns: inferência sempre ativa, caixa de treinamento durante o dia útil, execuções em lote nos finais de semana.

Tier é a segunda alavanca. A capacidade sob demanda é garantida enquanto você a mantiver e tem um preço premium; instâncias spot, comunitárias e interrompíveis são capacidade ociosa vendida 20–50% mais barata, com a vantagem de que o fornecedor pode recuperá-las. Para treinamento com pontos de verificação ou trabalhos em lote tolerantes a falhas, o spot está próximo do dinheiro grátis; para um endpoint de inferência que não pode piscar, o prêmio sob demanda proporciona estabilidade. A tabela mostra as duas taxas para cada cartão para que a compensação esteja na sua frente. Depois de obter o número de aluguel, a verdadeira questão é se possuir horas de GPU realmente é melhor do que pagar por token – resolva isso com o calculadora LLM vs API auto-hospedada, então defina o preço da largura de banda que seu modelo atende com o calculadora de saída de nuvem e os próprios pontos finais da inferência com o calculadora de custo de função sem servidor.

Como usar

1. Escolha sua GPU – suas taxas típicas sob demanda e spot são carregadas automaticamente.
2. Escolha sob demanda ou spot e defina quantas GPUs você está executando.
3. Defina as horas por mês ou use o menu suspenso de configuração rápida para um ciclo de trabalho comum.
4. Leia o custo mensal e a economia pontual e compare cada GPU na tabela.

Erros comuns

Supondo que esteja sempre ligado. 730 horas é o máximo, não o seu uso – a maioria das cargas de trabalho precisa de muito menos. Esquecendo as contas de tempo ocioso. Uma GPU deixada em execução entre trabalhos ainda custa a taxa integral; desligue-o ou use o escalonamento automático. Escolhendo a maior carta. Um L4 ou 4090 geralmente atende a um modelo pequeno por uma fração do custo de um H100 – combine a GPU com o modelo. Ignorando armazenamento e saída. Volumes, snapshots e transferência de dados são itens de linha separados; adicione armazenamento acima e saída de preço separadamente.

Perguntas frequentes

Qual GPU eu preciso para meu modelo?

Aproximadamente: modelos 7–13B cabem em um L4, RTX 4090 ou A100 40GB; Os modelos da classe 70B precisam de um A100/H100 de 80 GB ou de vários cartões. Maior não é mais barato se uma placa menor lidar com a carga – combine a VRAM com o modelo e tamanho do lote.

Quantas horas está "sempre ligado"?

Cerca de 730 – isso é 24 × 365 ÷ 12. Qualquer valor menor que o uso contínuo deve definir as horas reais, já que o custo aumenta linearmente com elas.

Por que os preços diferem tanto entre os fornecedores?

Nuvens especializadas (RunPod, Vast.ai, Lambda) e mercados comunitários/spot reduzem significativamente os hiperescaladores para o mesmo silício. As taxas aqui são uma combinação de mercado médio – o preço ao vivo do seu provedor é o que conta.

Isso inclui o custo da própria API do modelo?

Não – isso é aluguel bruto de GPU. Para comparar aluguel e auto-hospedagem com uma API por token, use o calculadora auto-hospedada vs API.

Estimativa apenas. As taxas de GPU mudam constantemente e variam de acordo com o provedor e a região. Verifique os preços em tempo real antes de confiar neles.

Hospede seu projeto:DigitalOcean – $ 200 grátis ↗VPS da Hostinger
Compare mais de 300 preços de modelos de IACalculadora de latência e tempo de resposta LLMCalculadora de custo de armazenamento de banco de dados vetorialCalculadora de palavras em tokensCalculadora de custos da API Vision