piattaforma/mese più economica
RunPod/mese
Baseten/mese
Modale/mese
Diffusione dei costi: stessa tariffa GPU nominale $/ora

Ripartizione della fatturazione per piattaforma

Stessi input di cui sopra, applicati attraverso la logica di fatturazione distinta di ciascuna piattaforma. Le unità fatturate al giorno rappresentano la quantità grezza effettivamente addebitata da ciascuna piattaforma: secondi per RunPod e Modal, minuti per Baseten.

PiattaformaUnità di fatturazioneFatturato/giornoCosto/giornoCosto/mese

Costo mensile per tasso di avvio a freddo (intensità del traffico)

Stessa durata, tariffa e input buffer di cui sopra, suddivisi in base alla tariffa di avvio a freddo: quanto sono distribuite le tue richieste. La riga evidenziata è quella più vicina all'attuale tasso di avvio a freddo immesso. Guarda come può cambiare la piattaforma più economica man mano che il traffico diventa più intenso.

Tasso di avviamento a freddoRunPod/meseBaseten/meseModale/meseIl più economico

Come si collega ad altri strumenti

Questo calcolatore valuta una domanda specifica e ristretta: per BURSTY, traffico di inferenza a basso QPS, in che modo la stessa tariffa nominale $/GPU ora si trasforma in fatture reali molto diverse a seconda dei meccanismi di fatturazione di una piattaforma: al secondo, al minuto con arrotondamento o al secondo più buffer di mantenimento. Non modella deliberatamente il noleggio di GPU a tariffa fissa e ad alto utilizzo, in cui si paga per ore continue indipendentemente dal modello di richiesta: per tale inquadratura, consultare la sezione Calcolatore dei costi del cloud GPU e il Calcolatore del costo di noleggio GPU, che considerano il costo della GPU come $/ora × ore utilizzate. Questo strumento esiste proprio perché i calcoli a tariffa fissa non funzionano in caso di carichi di lavoro sporadici e inclini all'avvio a freddo: uno strumento interno chiamato alcune centinaia di volte al giorno non si comporta come un'API occupata che blocca una GPU ad alto utilizzo e la differenza nella forma di fatturazione tra le piattaforme viene visualizzata solo una volta modellizzati esplicitamente gli avviamenti a freddo e i tempi di inattività anziché ipotizzare una tariffa fissa per ore.

Ospita il tuo progetto:DigitalOcean: $ 200 gratis ↗Hostinger VPS
Calcolatore dei costi del cloud GPUCalcolatore del costo di noleggio GPUCalcolatore LLM self-hosted e APICalcolatore dei costi del server MCP