Veröffentlicht am 11.07.2026 · basierend auf unserem neuen LLM-Preisverlaufs-Tracker – alle wichtigen Preisereignisse seit GPT-4, mit Datum
Wir haben alle wichtigen LLM-API-Preisänderungen von März 2023 bis heute in einer zusammengefasst Zeitleiste. Das Muster ist konsistenter als erwartet und übertrifft die meisten KI-Budgettabellen, die wir gesehen haben: Bei konstanter Kapazität sinken die Preise etwa um das Zehnfache pro Jahr. Nicht schrittweise – in Schritten und normalerweise aus Richtungen, die niemand vorhergesehen hat.
| Datum | Input der Grenzklasse, 1 Mio. USD | vs. GPT-4-Start |
|---|---|---|
| März 2023 (GPT-4) | $30.00 | — |
| August 2024 (GPT-4o nach Schnitt) | $2.50 | −92 % |
| 2026 (Gastgeber mit offenem Gewicht) | <1,00 $ | −97 % |
Historische Listenpreise. Vollständige Zeitleiste mit 14 datierten Ereignissen auf der Preisverlaufsseite.
Auf den Mechanismus kommt es an: Einzelne Modelle werden selten günstiger (die beiden Schnitte von GPT-4o waren die Ausnahme). Was tatsächlich passiert, ist Ersatz — Jede neue Generation wird auf der niedrigeren Ebene der vorherigen Generation versendet. Der GPT-4o mini schlug den GPT-3.5 Turbo um ein Drittel seines Preises. DeepSeek V2 lieferte für 0,14 US-Dollar eine nahezu bahnbrechende Qualität. Sie überleben die Deflation nicht, indem Sie auf Rabatte warten; Sie fahren damit, indem Sie die Stufe neu einkaufen.
Jahresverträge zu den heutigen Konditionen. Ein für 12 Monate gesperrter Mengenrabatt von 30 % ist ein Verlust, wenn die Marktpreise in diesem Zeitfenster um 60–90 % fallen – und das ist in der Vergangenheit auch der Fall. Alles, was länger als 6–12 Monate dauert, ist eine Wette gegen einen Dreijahrestrend. Wenn Sie sich verpflichten müssen, verpflichten Sie sich zu Ausgaben und nicht zu einer bestimmten Preisliste eines Modells.
„KI ist für dieses Feature zu teuer“-Entscheidungen. Eine Funktion, die heute 10.000 US-Dollar pro Monat kostet, kostet bei gleicher Qualität innerhalb von 18 Monaten wahrscheinlich 1–3.000 US-Dollar. Die marginale Einheitsökonomie bedeutet heute in der Regel bald eine gute Einheitenökonomie – die Build-vs-Wait-Rechnung sollte die Kurve einbeziehen, nicht nur den heutigen Aufkleber.
Tiefe Ein-Anbieter-Integration. Beide diskontinuierlichen Preisschocks in unserer Zeitleiste (Mai 2024, Januar 2025) kamen von DeepSeek – einem Außenseiter. Teams mit anbieterunabhängigem Routing erfassten diese Preise innerhalb weniger Tage; Teams, die zu einem SDK zusammengeschlossen waren, sahen von der Seitenlinie aus zu. Die technischen Kosten einer Abstraktionsschicht sind eine Versicherungsprämie für den nächsten Schock.
Zwei ehrliche Vorbehalte aus den Daten. Erste, Die Produktionspreise fallen langsamer – GPT-4 gestartet mit Ausgang bei 2× Eingang; Heute sind 4- bis 5-fache Übersetzungsverhältnisse Standard. Ausgabeintensive Arbeitslasten (Codegenerierung, lange Antworten) entleeren sich deutlich langsamer als die Überschrift. Zweite, Die Preise steigen: Claude 3.5 Haiku wurde zum 3,2-fachen Preis seines Vorgängers auf den Markt gebracht, da es im Benchmarking wie ein Mittelklassemodell abschneidet. Die günstige Stufe günstig zu bleiben ist eine Gewohnheit, keine Garantie – programmieren Sie es niemals fest.
Vierteljährlich, fünfzehn Minuten: Geben Sie Ihren echten Token-Mix in die Über 300 Modellvergleiche und prüfen Sie, ob Ihr aktuelles Modell noch seine Stufe gewinnt. Wenn dies nicht der Fall ist, wird die Preisnachlass-Sparrechner Preise für die Migration. Die meisten Teams, die wir modellieren, stellen beim ersten Mal eine Ersparnis von 30–60 % fest – Geld, das einfach deshalb auf dem Tisch lag, weil die Modellauswahl vor zwei Quartalen getroffen wurde.
Bei allen Zahlen handelt es sich um historische Listenpreise, zusammengestellt im Juli 2026 – Details und Quellen auf der Preisverlaufsseite. Verwandt: Preisvergleich für KI-Modelle · Einsparungen beim Modellrouting · Günstigste LLM-API.