So funktioniert dieser Rechner
Kostenloser Kosten-pro-Konversations-Rechner – modellieren Sie, wie das erneute Senden des Kontexts in jeder Runde dazu führt, dass ein Chat mit mehreren Runden weitaus mehr kostet als die hinzugefügten Token.
Häufig gestellte Fragen
Warum kostet ein langes Gespräch mehr als seine Token?
Weil das Modell zustandslos ist: In jeder Runde wird die gesamte vorherige Konversation erneut als Eingabe gesendet. In der achten Runde zahlen Sie achtmal für die erste Runde. Die Gesamtzahl der in Rechnung gestellten Token wächst ungefähr mit dem Quadrat der Anzahl der Runden, sodass die Länge und nicht nur die Nachrichtengröße die Kosten bestimmt.
Wie kann ich die Kosten pro Gespräch senken?
Schneiden Sie alte Abbiegevorgänge ab oder fassen Sie sie zusammen, anstatt alles erneut zu senden. Verwenden Sie Prompt-Caching, damit das wiederholte Präfix mit einem Rabatt abgerechnet wird, begrenzen Sie die Gesprächsdauer und leiten Sie einfache Abbiegevorgänge an ein günstigeres Modell weiter. Diese greifen den erneut gesendeten Kontext an, was lange Chats teuer macht.