So funktioniert dieser Rechner
Der Kostenrechner für 1.000 Anfragen wandelt Ihre Token-Nutzung pro Anfrage und die Token-Preise Ihres Modells in Dollarkosten für alle tausend API-Aufrufe um. Sie geben vier Werte ein: Eingabetoken pro Anfrage, Ausgabetoken pro Anfrage, Die Eingabepreis pro 1 Mio. Token, und die Ausgabepreis pro 1 Mio. Token. Das Tool multipliziert jede Token-Anzahl mit der entsprechenden Rate pro Million, addiert die Eingabe- und Ausgabeseite, um die Kosten einer einzelnen Anfrage zu ermitteln, und skaliert diese dann um 1.000. Das Ergebnis ist eine einzige, vergleichbare Zahl – Kosten pro 1.000 Anfragen –, über die sich viel leichter rechnen lässt als über Bruchteile eines Cents pro Anruf.
Dies ist wichtig, da die API-Rechnungen mit dem Volumen skalieren und die Kosten pro Anfrage anfallen Aussehen Trivial wird bedeutsam, wenn man es mit dem realen Verkehr multipliziert. Der wichtigste Kompromiss, den es zu beobachten gilt, ist dieser Ausgabe-Tokens kosten in der Regel ein Vielfaches mehr als Eingabe-Tokens, sodass eine ausführliche Antwort die Gesamtsumme dominieren kann, selbst wenn Ihre Eingabeaufforderung kurz ist. Bevor Sie sich für ein Modell entscheiden, lassen Sie Ihre realistischen Token-Größen durch den Rechner laufen und vergleichen Sie ein günstigeres Modell mit einem teureren Modell bei gleichem Volumen; Durch das Kürzen der Ausgabelänge oder das Begrenzen von Antwort-Tokens werden die Kosten pro 1.000 oft stärker gesenkt als durch einen Anbieterwechsel.
Häufig gestellte Fragen
Wie berechne ich die Kosten pro 1.000 Anfragen?
Kosten pro Anfrage = Eingabe-Tokens × Eingabepreis + Ausgabe-Tokens × Ausgabepreis (pro Million). Multiplizieren Sie mit 1.000, um die Promillezahl zu erhalten – die Einheit, in der die meisten API-Budgets begründet werden.
Warum pro 1.000 statt pro Anfrage?
Die Kosten pro Anfrage betragen winzige Bruchteile eines Cents, die schwer zu vergleichen sind. Pro 1.000 ist die Skala, bei der Unterschiede zwischen Modellen offensichtlich und budgetierbar werden.