Vollständige Preistabelle – Ihr Arbeitspensum
Referenz-Token im Wert von 1 Mio. $ (Juli 2026), monatliche Kosten für Ihre oben genannten Zahlen.
| Anbieter | Modell | In $/1 Mio | Out $/1 Mio | Kosten/Mo |
|---|
Am günstigsten je nach Anwendungsfall
- Großvolumig / einfach (Klassifizierung, Extraktion, Routing): Gemini 2.0 Flash oder GPT-4o mini – ein paar Cent pro tausend Anfragen.
- Chatbots & Support: GPT-4o mini oder Gemini 2.5 Flash – günstig, schnell, gut genug; siehe die Chatbot-Kostenrechner.
- RAG / langer Kontext: Gemini 2.5 Flash oder Pro (niedriger Eingabepreis hilft, wenn Sie abgerufene Stücke hineinstopfen); siehe die RAG-Kostenrechner.
- Harte Argumentation/Codierung: Claude Sonnet 4 oder GPT-4o; Claude Opus / o3 nur dann, wenn Sie es wirklich brauchen.
- Benötigen Sie eine kostenlose Stufe: Gemini (AI Studio) ist das einzige der drei Unternehmen mit einem echten kostenlosen Kontingent.
Wie man tatsächlich wählt
Markentreue ist die teuerste Angewohnheit in der KI. Die drei Anbieter übertreffen sich ständig gegenseitig, und der tatsächliche Kostenunterschied ergibt sich aus zwei Dingen, die Sie steuern: dem Modellebene Sie wählen und wie lange deine Ausgänge Sind. Ein Grenzmodell mit kurzen Antworten kann günstiger sein als ein „billiges“ Modell mit weitläufigen Antworten. Bewerten Sie den Arbeitsaufwand, nicht das Logo – die Tabelle oben macht genau das für Ihre eigenen Zahlen.
Machen Sie einen Drilldown zu einem Anbieter mit dem GPT-4o-Rechner, Die Claude-Rechner oder die Zwillinge-Rechner, vergleichen Sie alle Modelle auf einmal auf der Vollständiger KI-API-Kostenrechner, oder schätzen Sie ein ganzes Produkt mit dem Kostenschätzer für KI-Apps.
Sobald Sie sich für ein Modell entschieden haben, reduzieren drei Hebel die Rechnung noch weiter, und alle drei Anbieter bieten alle drei an. Sofortiges Caching Bepreist wiederholte Systemaufforderungen und Dokumente zu einem Bruchteil der normalen Eingaberate neu – es lohnt sich für jede App, die bei jedem Aufruf dieselben Anweisungen oder denselben Kontext erneut sendet; Größe auf der Rechner für schnelle Caching-Einsparungen. A Batch-API gibt etwa 50 % Rabatt für Aufträge, die ein paar Stunden warten können, anstatt eine Live-Antwort zu benötigen; siehe die Batch-API-Einsparungsrechner. Und für Apps mit hohem Volumen Routenführung Regelmäßige Nachfragen nach einem günstigeren Modell, während das Flaggschiff für Hartschalenkoffer reserviert wird, ist oft der größte Hebel von allen – modellieren Sie es auf dem Kostenrechner für AI-Modell-Router.
Ein weiterer Unterschied, der in der Preistabelle nicht auftaucht: nur Zwillinge verfügt über eine wirklich kostenlose API-Stufe (Google AI Studio, keine Karte erforderlich), was es zur kostengünstigsten Möglichkeit macht, Prototypen zu erstellen, bevor Sie Geld ausgeben. OpenAI und Anthropic erfordern beide die Einrichtung der Abrechnung bei der ersten Anfrage, neue Konten erhalten jedoch eine begrenzte Testgutschrift.
FAQ
Was ist am günstigsten: OpenAI, Claude oder Gemini? Bei den günstigsten leistungsfähigen Modellen liegen Gemini 2.0 Flash (0,10 $ / 0,40 $ pro 1 Mio. Token) und GPT-4o mini (0,15 $ / 0,60 $) vorne. Unter den Flaggschiffen hat Gemini 2.5 Pro den niedrigsten Einstiegspreis, GPT-4o liegt in der Mitte und Claude Opus ist das teuerste – der Gewinner hängt von der benötigten Stufe ab, nicht von der Marke.
Ist Claude teurer als GPT-4o? Claude Sonnet 4 (3 $ / 15 $) ist etwas teurer als GPT-4o (2,50 $ / 10 $), und Claude Opus 4 ist weitaus teurer – aber Claude Haiku 3.5 unterbietet GPT-4o. Vergleichen Sie die Arbeitslast, die Sie tatsächlich ausführen, da die Ausgabelänge die Rechnung dominiert.
Unterstützen alle drei Prompt-Caching und Batch-Rabatte? Ja – alle drei bieten Caching für wiederholte Eingabeaufforderungen und eine Batch-API zum etwa halben Preis. Die tatsächlichen Einsparungen hängen davon ab, wie repetitiv Ihre Eingabeaufforderungen sind und ob Ihr Auftrag die Batch-Verzögerung tolerieren kann.
Verfügt einer der drei Anbieter über eine kostenlose API-Stufe? Gemini ist der Einzige – Google AI Studio bietet kostenlosen Zugang mit Tarifbeschränkungen, die großzügig genug für die Prototypenerstellung sind. OpenAI und Anthropic erfordern zunächst die Einrichtung der Abrechnung, obwohl beide neuen Konten nur begrenzte Testguthaben gewähren.