Perzentil Schritte Kosten/Lauf Tägliche Flottenkosten Empfohlene max_steps

Warum Durchschnittskosten das falsche Budget sind

Agentenschleifen führen keine feste Anzahl von Schritten aus – sie laufen, bis die Aufgabe erledigt ist oder eine Obergrenze erreicht wird. Ein Codierungsagent, der durchschnittlich 8 Toolaufrufe durchführt, kann bei einem kniffligen Refactoring auf 25 ansteigen. Wenn Sie nur den Durchschnitt einplanen, scheitern diese Long-Tail-Läufe entweder mitten in der Aufgabe oder sprengen Ihre monatliche Rechnung.

P95-Budget: deckt 95 von 100 Läufen ab. Gut für unkritische Aufgaben, bei denen gelegentliche Neustarts akzeptabel sind.

P99-Budget: deckt 99 von 100 Läufen ab. Geeignet für Produktionsmitarbeiter, bei denen unvollständige Aufgaben kostspielig sind.

Max_steps cap = P99: Wenn ein Agent immer noch mit der P99-Schrittzahl ausgeführt wird, steckt er mit ziemlicher Sicherheit in einer Schleife fest. Eine feste Obergrenze stoppt hier außer Kontrolle geratene Kosten, ohne die normale Fertigstellung zu unterbrechen.

Vergleichen Sie mit Kostenrechner für KI-Agenten, Kosten pro gelöstem Ticket, Und API-Budgetplaner.

Hosten Sie Ihr Projekt:DigitalOcean – 200 $ kostenlos ↗Hostinger VPS
Kostenrechner für die LLM-EvaluierungKostenrechner für die Erzeugung synthetischer DatenAI-Seat-Lizenz vs. API-KostenrechnerZeit- und Kostenrechner für die StapelverarbeitungKI-Kosten-pro-Benutzer-Rechner