So funktioniert dieser Rechner
Der Prompt-Cache-Break-Even-Rechner Schätzt, wie viele Wiederverwendungen eines zwischengespeicherten Eingabeaufforderungspräfixes erforderlich sind, bevor das Zwischenspeichern weniger kostet als die Zahlung des vollen Eingabepreises für jeden Aufruf. Sie betreten die zwischengespeicherte Präfix-Tokens, Die Basis-Eingabepreis pro Million Tokenund zwei Multiplikatoren: der Cache-Schreib-Multiplikator (die Prämie, die Sie zahlen, wenn das Präfix zum ersten Mal gespeichert wird) und die Cache-Lese-Multiplikator (der steile Rabatt auf jeden weiteren Treffer). Gegen die Wiederverwendung innerhalb der TTL und die TTL in Minuten, ermittelt es den Break-Even-Punkt – die Anzahl der Treffer, bei denen die einmalige Schreibprämie durch günstigere Lesevorgänge zurückgezahlt wird. Die Hauptfaktoren sind die Präfixgröße, die Lücke zwischen den Schreib- und Lesemultiplikatoren und die Häufigkeit, mit der Sie das Präfix tatsächlich wiederverwenden, bevor es abläuft.
Der wichtigste Kompromiss ist Schreiben Sie Prämien im Vergleich zu Leseeinsparungen unter einer tickenden Uhr. Caching lohnt sich nur, wenn das gleiche Präfix vor Ablauf der TTL oft genug wiederverwendet wird; Ein großes, selten wiederverwendetes Präfix kann mehr kosten, als überhaupt kein Caching durchzuführen, da Sie die Schreibprämie zahlen und den Eintrag verfallen lassen, bevor sich die billigen Lesevorgänge ansammeln. Beobachten Sie den Datenverkehr, der in Schüben eintrifft, die kürzer sind, als Ihre Wiederverwendungsanzahl erfordert – wenn sich Anfragen über die TTL hinaus verbreiten, löst jeder einzelne einen Schreibvorgang erneut aus. Ein praktischer Tipp: Vergleichen Sie zuerst Ihren tatsächlichen Anforderungsabstand mit der TTL, da ein Präfix, das innerhalb des Fensters zweimal wiederverwendet wird, oft besser ist als ein Präfix, das bei Ablaufdauern zehnmal wiederverwendet wird.
Häufig gestellte Fragen
Wann spart Prompt Caching tatsächlich Geld?
Beim Caching wird ein einmaliger Aufpreis für das Schreiben des Präfixes berechnet (etwa das 1,25-fache der Basiseingabe bei Anthropic) und dann werden Lesevorgänge mit etwa 10 % der Basis berechnet. Sie erreichen die Gewinnschwelle, sobald der Rabatt aus genügend Wiederverwendungen die Schreibprämie übersteigt – oft schon nach ein oder zwei Treffern. Darunter oder wenn der Cache vor einer Wiederverwendung abläuft (Standard-TTL von 5 Minuten), wird die Schreibprämie verschwendet.
Was ist die Cache-TTL und warum ist sie wichtig?
Die Lebensdauer gibt an, wie lange ein zwischengespeichertes Präfix warm bleibt – standardmäßig 5 Minuten, mit einer längeren Option von 1 Stunde bei höheren Schreibkosten. Jede Wiederverwendung setzt es zurück oder erweitert es. Wenn Ihre Anfragen weiter voneinander entfernt sind als die TTL, schreibt jeder Aufruf den Cache neu und Sie zahlen wiederholt die Prämie anstelle des billigen Lesevorgangs, wodurch die Einsparungen zunichte gemacht werden.