Sitzungslautstärke

Token-Kosten pro Sitzung

Tool-Aufrufe (z. B. Websuche)

Laufzeit / Monat
Token / Monat
Werkzeugaufrufe/Monat
Gesamt / Monat

Kosten nach Maßstab

Die Laufzeitkosten skalieren mit der Dauer der Sitzungsdauer, unabhängig davon, wie viel das Modell geleistet hat. Die Token-Kosten richten sich danach, wie viel tatsächlich gelesen und geschrieben wurde. Beide wachsen linear mit der Anzahl der Sitzungen, aber ein langsamer Agent zahlt unverhältnismäßig mehr Laufzeit pro Sitzung.

Sitzungen/MonatLaufzeitTokenWerkzeugeGesamt

Warum die Abrechnung nach Sitzungsstunden eine separate Position ist

Gehostete Agent-Plattformen berechnen zunehmend die Laufzeitumgebung selbst – die Sandbox, den Browserkontext oder den Ausführungscontainer, in dem der Agent ausgeführt wird – zusätzlich zu den Standardmodell-Token-Tarifen. Ein repräsentativer Tarif für 2026 liegt bei etwa 0,08 US-Dollar pro aktiver Laufzeitstunde. Dies ist kein Ersatz für die Token-Preisgestaltung, sondern eine Ergänzung: Eine lange Agentensitzung zahlt sich sowohl für die Dauer der Bereitstellung der Umgebung als auch für jedes Token aus, das das zugrunde liegende Modell liest oder schreibt, während diese Umgebung aktiv ist. Zwei Agenten, die die gleiche Aufgabe ausführen, können sehr unterschiedliche Rechnungen verursachen, wenn einer in 90 Sekunden fertig ist und der andere 8 Minuten benötigt, selbst bei nahezu identischer Token-Anzahl, da der langsamere Agent die abgerechnete Laufzeit länger in Anspruch nimmt.

Dies ist genau die Lücke zwischen diesem Rechner und einem reinen Agentenkostentool pro Schritt oder pro Token: Der vom Modell aufgerufene Preis fügt die Dimension hinzu, die mit der Zeit in der Sitzung und nicht mit der geleisteten Arbeit skaliert. Am wichtigsten ist es für Agenten, die auf langsame Tool-Aufrufe warten, Seiten durchsuchen oder lange Tool-Nutzungsschleifen ausführen – die Zeit, die das Modell in einer aktiven Sitzung im Leerlauf verbringt, verbraucht immer noch die Abrechnung der Sitzungsstunden, auch wenn während dieser Wartezeit nur sehr wenige Token verbrannt werden.

Hinzu kommt die gemessene Tool-Nutzung – ein durchschnittlicher Preis für ein integriertes Web-Suchtool im Jahr 2026 liegt bei etwa 10 US-Dollar pro 1.000 Suchanfragen. Ein Agent, der großzügig sucht, kann unabhängig von seiner Laufzeit und seiner Token-Rechnung erhebliche Werkzeugkosten ansammeln. Die gesamten Agentenkosten im Jahr 2026 belaufen sich in Wirklichkeit auf drei gestapelte Zähler: Laufzeitstunden, Token und Toolaufrufe – wenn man einen von ihnen als „die“ Kosten betrachtet, wird die tatsächliche Rechnung unterschätzt. Informationen zur reinen Pro-Schritt-/Token-Ansicht ohne Laufzeitabrechnung finden Sie unter Kostenrechner für KI-Agenten oder die Agentenschleifen-Budgetrechner für die P99-Planung außer Kontrolle geratener Kosten.

Hosten Sie Ihr Projekt:DigitalOcean – 200 $ kostenlos ↗Hostinger VPS
Kostenrechner für KI-AgentenAgent-Loop-BudgetKosten für den AI-Agent-SchrittKosten für ComputernutzungsagentenKosten für Web-Suchtools