reserviert / Monat
vs. On-Demand
effektiv $/1 Mio
genutzte Kapazität

Effektiver Preis bei steigendem Volumen

Die Reservierungskosten sind fest, sodass jeder zusätzliche Token den effektiven Preis pro Million senkt – bis Sie die Kapazitätsgrenze erreichen und die Rechnungen zum On-Demand-Tarif überlaufen.

Monatliches VolumenKosten nach BedarfReserviert mit einer Gültigkeit von 1 Mio. $Günstiger

Reservekapazität nur oberhalb der Gewinnschwelle

Bereitgestellter Durchsatz – PTUs auf Azure OpenAI, bereitgestellter Durchsatz auf AWS Bedrock – tauscht eine Rechnung pro Token gegen eine feste monatliche Reservierung dedizierter Kapazität. Es erkauft sich eine vorhersehbare Latenz und Pauschalkosten, spart aber erst dann Geld, wenn Ihr stabiles Token-Volumen die Gewinnschwelle erreicht: die Reservierungskosten geteilt durch den On-Demand-Preis pro Token. Darunter zahlen Sie für ungenutzte Einheiten; Darüber verteilen sich die Fixkosten auf mehr Token und Ihr effektiver Preis pro Million sinkt weiter, bis hin zur Kapazitätsobergrenze von Einheiten × Token pro Minute × Minuten im Monat. Überschreiten Sie die Obergrenze und die überlaufenden Rechnungen zum vollen On-Demand-Tarif, wodurch der Rabatt stillschweigend ausgehöhlt wird. Passen Sie die Reservierung an das Volumen an, von dem Sie überzeugt sind, dass Sie es jeden Monat nutzen werden, und prognostizieren Sie ein Wachstum API-Kostenprognoserechner, und vergleichen Sie eine Ausgabenverpflichtung für die Rabattrechner für zugesagte Ausgaben.

Hosten Sie Ihr Projekt:DigitalOcean – 200 $ kostenlos ↗Hostinger VPS
Kostenrechner für die LLM-EvaluierungKostenrechner für die Erzeugung synthetischer DatenAI-Seat-Lizenz vs. API-KostenrechnerZeit- und Kostenrechner für die StapelverarbeitungKI-Kosten-pro-Benutzer-Rechner