Veröffentlicht am 30.06.2026 · Referenzpreise, vor der Budgetierung überprüfen
Der LLM-Preiskampf 2026 hat eine neue Form: xAIs Grok hat sich als Kostenführer in die Diskussion eingebracht, OpenAI und Google haben sich in klare Budget- und Premium-Stufen aufgeteilt und Claude von Anthropic steht immer noch an der Spitze der Preisskala. Um den Vergleich ehrlich zu machen, haben wir getan, was wir immer tun: Wir haben eine Arbeitslast behoben und den Preis für jedes größere Modell festgelegt. Der Job: 1.000.000 Anfragen, jede 1.000 Input-Tokens und 500 Output-Tokens (ein typischer kurzer Chat oder Generationsanruf). Das sind 1 Milliarde Input-Tokens und 500 Millionen Output-Tokens.
| Modell | In $/1 Mio | Out $/1 Mio | Kosten für 1 Mio. Anfragen |
|---|---|---|---|
| Grok 4.1 Schnell günstigste Grenze | $0.20 | $0.50 | $450 |
| DeepSeek V3 | $0.27 | $1.10 | $820 |
| GPT-5.4 mini | $0.40 | $1.60 | $1,200 |
| Gemini 2.5 Flash | $0.30 | $2.50 | $1,550 |
| Gemini 3.1 Pro | $2.00 | $12.00 | $8,000 |
| GPT-5.4 | $2.50 | $15.00 | $10,000 |
| Grok 4 (Flaggschiff) | $3.00 | $15.00 | $10,500 |
| Claude Opus 4.6 | $5.00 | $25.00 | $17,500 |
Bei den Preisen handelt es sich um Referenzschätzungen, Juli 2026. Veralteten Preis melden →
Gleicher Arbeitsaufwand, 450 $ für Grok 4.1 Fast im Vergleich zu 17.500 $ für Claude Opus 4.6 - A ~39× Verbreitung. Die wichtigste Entscheidung bei Ihrer KI-Rechnung ist immer noch, welches Modell Sie wählen, und im Jahr 2026 verlagerte sich das günstige Ende der Grenze auf xAI.
Grok ging preislich aggressiv vor. Die Fast-Stufe von xAI mit 0,20 $/0,50 $ übertrifft sogar DeepSeek bei der Ausgabe und liegt weit unter jedem Western-Frontier-Modell – ein bewusster Landraub, gebündelt mit einem riesigen Kontextfenster und Live-X-Daten. OpenAI und Google haben sich gespalten. Jeder hat jetzt ein wirklich günstiges kleines Modell (GPT-5.4 mini, Gemini 2.5 Flash) und ein teures Flaggschiff (GPT-5.4, Gemini 3.1 Pro), also „Was ist billiger, OpenAI oder Google?“ Kommt ganz darauf an, welche Stufe du meinst. Claude blieb Premium. Opus bleibt pro Token das teuerste Unternehmen unter den Majors – Anthropic orientiert sich bei der Preisgestaltung an Leistungsfähigkeit und Zuverlässigkeit, nicht an der Kostenführerschaft. Wenn Ihr Budget die Einschränkung darstellt, sollten Sie sich Claude Haiku (viel billiger) ansehen, nicht Opus.
Die Zahl, die diese Tabelle gewinnt, gewinnt nicht automatisch Ihr Projekt. Ein günstigeres Modell, das einen erneuten Versuch erfordert, längere Antworten schreibt oder bei schwierigen Eingabeaufforderungen scheitert, kann in der Praxis mehr kosten als ein teureres Modell, das beim ersten Mal alles schafft. Auch die Ausgabelänge ist wichtig – die Ausgabe wird hier für jedes Modell mit dem 2,5- bis 5-fachen der Eingabe berechnet, sodass ein ausführliches, billiges Modell gegen ein knappes, teures Modell verlieren kann. Das Muster, auf das sich die meisten Teams einigen, ist Abstufung: Leiten Sie routinemäßigen, hochvolumigen Datenverkehr an ein günstiges Modell (Grok Fast, Gemini Flash, DeepSeek) weiter und eskalieren Sie nur die wirklich schwierigen Anfragen an ein Flaggschiff. Selbst wenn Sie 20 % der Anrufe an ein Premium-Modell weiterleiten, bleiben Ihre Gesamtkosten am günstigen Ende der Tabelle.
Sobald das Modell ausgewählt ist, beeinflussen drei Dinge die Rechnung: Ausgangsobergrenzen (Satz max_tokens — Output ist die teure Hälfte), sofortiges Caching (Wiederholte Systemaufforderungen werden bei OpenAI, Anthropic, Grok und DeepSeek mit einem erheblichen Rabatt berechnet) und Routenführung (Billig zuerst, eskalieren bei Unsicherheit). Jeder verbindet sich mit dem anderen. Modellieren Sie die Einsparungen mit dem Prompt-Caching-Rechner und die Modell-Routing-Rechner.
Ihre Token gehören nicht uns, daher kann sich die Rangfolge bei ausgabelastigem oder eingabelastigem Datenverkehr ändern. Schließen Sie Ihre tatsächlichen Ein-/Ausgangslängen und Lautstärken an günstigster LLM-API-Ranker – es sortiert jedes Modell nach dein Zahlen – oder die KI-API-Kostenrechner. Etwas Bestimmtes bauen? Benutzen Sie die Kostenschätzer für KI-Apps, und wenn Sie AI in einem Abonnement weiterverkaufen, wird die Preisrechner für AI-Wrapper Zeigt an, ob Ihr Preis die API-Kosten tatsächlich ausgleicht. Leitfäden pro Anbieter: Grok, OpenAI, Claude, Zwillinge, DeepSeek.
Öffnen Sie den günstigsten LLM-API-Ranker → - OpenAI gegen Claude gegen Gemini →
Referenzpreise (Juni 2026), ermittelt aus öffentlichen Preisseiten und Anbietervergleichen; Modellnamen und Preise ändern sich häufig – überprüfen Sie dies vor der Budgetierung. Keine Verbindung zu irgendeinem Anbieter.