günstigste Plattform / Monat
RunPod / Monat
Baseten / Monat
Modal / Monat
Kostenspanne – gleicher nominaler GPU-Preis in Höhe von $/Stunde

Abrechnungsaufschlüsselung nach Plattform

Dieselben Eingaben wie oben, angewendet über die unterschiedliche Abrechnungslogik jeder Plattform. In Rechnung gestellte Einheiten/Tag stellen die Rohmenge dar, die jede Plattform tatsächlich in Rechnung stellt – Sekunden für RunPod und Modal, Minuten für Baseten.

PlattformAbrechnungseinheitIn Rechnung gestellt / TagKosten/TagKosten/Monat

Monatliche Kosten nach Kaltstartrate (Verkehrsstoß)

Gleiche Eingaben für Dauer, Rate und Puffer wie oben, gestrichen für die Kaltstartrate – wie verteilt Ihre Anforderungen sind. Die hervorgehobene Zeile kommt Ihrer aktuellen Kaltstartrateneingabe am nächsten. Sehen Sie, wie sich die günstigste Plattform ändern kann, wenn der Verkehr zunimmt.

KaltstartrateRunPod / MonatBaseten / MonatModal / MonatGünstigstes

Wie dies mit anderen Tools verbunden ist

Dieser Rechner stellt eine konkrete, eng gefasste Frage: Wie lässt sich für BURSTY-Inferenzverkehr mit niedrigem QPS derselbe nominelle $/GPU-Stunde-Tarif in sehr unterschiedliche tatsächliche Rechnungen umwandeln, abhängig von den Abrechnungsmechanismen einer Plattform – pro Sekunde, pro Minute gerundet oder pro Sekunde plus Warmhaltepuffer? Es handelt sich bewusst nicht um eine pauschale GPU-Vermietung mit hoher Auslastung, bei der Sie unabhängig vom Anforderungsmuster für fortlaufende Stunden bezahlen – für diesen Rahmen siehe die GPU-Cloud-Kostenrechner und die GPU-Mietkostenrechner, die beide die GPU-Kosten als $/Stunde x genutzte Stunden behandeln. Dieses Tool gibt es genau deshalb, weil diese Pauschalberechnung bei sporadischen, zu Kaltstarts neigenden Workloads nicht funktioniert – ein internes Tool, das ein paar hundert Mal am Tag aufgerufen wird, verhält sich überhaupt nicht wie eine ausgelastete API, die eine GPU bei hoher Auslastung festhält, und der Unterschied in der Abrechnungsform zwischen den Plattformen zeigt sich erst, wenn Sie Kaltstarts und Leerlaufzeiten explizit modellieren, anstatt eine Flatrate in Stunden anzunehmen.

Hosten Sie Ihr Projekt:DigitalOcean – 200 $ kostenlos ↗Hostinger VPS
GPU-Cloud-KostenrechnerGPU-MietkostenrechnerSelbstgehosteter LLM vs. API-RechnerMCP-Serverkostenrechner