günstiger pro richtig
Prämie / richtig
günstiger / richtig
Break-Even-Genauigkeit

Aufkleberpreis im Vergleich zum Preis eines Ergebnisses

Für jedes Modell gibt es zwei Preismodelle: die Rohkosten pro Anruf und die effektiven Kosten, wenn man sie durch die Genauigkeit dividiert, um die Wiederholungsversuche zu finanzieren. In der Spalte „Wiederholungen“ steht die Genauigkeit – wie viele Versuche es durchschnittlich braucht, um eine gute Antwort zu erhalten. Die Zeile mit dem günstigsten Ergebnis pro korrekter Eingabe wird hervorgehoben. Es ist nicht immer der günstigste Aufkleber.

Modell$/AnrufGenauigkeitVersuche/richtig$/richtigMonatlich

Wie viel Genauigkeit das günstigere Modell benötigt

Die effektiven Kosten des günstigeren Modells bei verschiedenen Genauigkeiten im Vergleich zu den Fixkosten pro Korrektur des Premium-Modells. Die Zeile, in der sie sich kreuzen, ist die Break-Even-Genauigkeit – darüber gewinnt das günstigere Modell, darunter ist es aufgrund seiner Wiederholungsversuche die teurere Wahl.

Günstigere GenauigkeitGünstiger $/richtigPrämie $/richtigGewinner

Der Rabatt, der Sie Geld kostet

Jedes Modellauswahl-Dashboard ist nach dem Preis pro Million Token sortiert, und jedes einzelne davon beantwortet die falsche Frage. Die Kosten, die auf Ihrer Rechnung landen, sind nicht die Kosten eines Anrufs, sondern die Kosten eines Anrufs, den Sie tatsächlich nutzen können – und sobald es für Ihre Aufgabe eine richtige und eine falsche Antwort gibt, fallen diese beiden Zahlen auseinander. Ein Modell, das pro Anruf 30 % günstiger ist, aber zehn Punkte weniger genau, ist nicht 30 % günstiger; Sobald Sie es erneut versuchen oder die Fehler wegwerfen, kaufen Sie mehr Versuche pro brauchbarem Ergebnis, und die Arithmetik kann die Rangfolge völlig umdrehen. Die Lösung ist eine Division: Nehmen Sie die Kosten eines Versuchs, dividieren Sie sie durch die Wahrscheinlichkeit, dass der Versuch gut ist, und vergleichen Sie die Modelle darauf. Die Gewinnschwelle, die dieser Rechner ausgibt, ist die gesamte Entscheidung in einer einzigen Zahl – die Genauigkeit, die ein günstigeres Modell erreichen muss, bevor sein Rabatt real ist, und nicht eine Steuer, die Sie in Wiederholungsversuchen zahlen. Dies setzt voraus, dass Sie richtig von falsch unterscheiden können und die Fehler einfach erneut ausführen können. Dies ist genau der Fall, wenn Sie über eine Testsuite, einen Verifizierer oder eine menschliche Überprüfung verfügen. Wenn schlechte Antworten unentdeckt weitergegeben werden, ist das Billigmodell noch schlimmer, da Sie jetzt auch die Kosten dafür tragen, dass Sie nachgelagert falsch liegen. Kosten Sie zunächst einen Einzelanruf mit dem Token-Kostenrechner, vergleichen Sie die Rohmodellpreise auf der Modellvergleichsseite, und wenn Sie Anrufe an einen Agenten verketten, legen Sie die Größe des Token-Burns für die vollständige Aufgabe mit fest Kostenrechner für KI-Agenten.

Hosten Sie Ihr Projekt:DigitalOcean – 200 $ kostenlos ↗Hostinger VPS
Token-KostenPreis/LeistungA/B-TestkostenKosten für KI-AgentenModellvergleich