Modell und Verwendung
—Token-Kosten/Abfrage
—Recherchegebühren / Abfrage
—Gesamt / Abfrage
o4-mini vs. o3 – gleiche Arbeitslast, beide Stufen
Die Preise für Ihr Token und Ihr Suchprofil gelten für beide Deep-Research-Stufen. Die Suchgebühren sind bei beiden identisch – nur die Token-Preise ändern sich, sodass die Lücke größer wird, je länger Ihre Berichte dauern.
| Modell | Token/Abfrage | Suchen / abfragen | Gesamt/Abfrage | Monatlich |
|---|
Warum tiefgreifende Rechercheabfragen Dollar und nicht Cent kosten
Deep-Research-Modelle haben den gleichen Preis wie gewöhnliche Modelle auf dem Papier – Dollar pro Million Token –, aber sie verbrauchen Token wie nichts anderes in Ihrem Stapel. Eine einzelne Abfrage führt autonom eine Rechercheschleife durch: Sie führt ihre eigenen Websuchen aus, liest die gefundenen Seiten als Eingabe-Tokens in das Kontextfenster ein, begründet ausführlich, was sie gefunden hat (wird als Ausgabe-Tokens abgerechnet, obwohl Sie die meisten Begründungen nie sehen) und schreibt schließlich einen langen strukturierten Bericht. Eine realistische Aufgabe bringt etwa 50.000 Eingabe-Tokens, 20.000 Ausgabe-Tokens und 15 Websuchen ein – etwa 0,41 $ für o4-mini-deep-research und 1,45 $ für o3-deep-research. Vergleichen Sie das mit einem typischen Chat-Abschluss, der nur den Bruchteil eines Cents kostet.
Der Werbebuchungsposten, den die meisten Leute übersehen, ist die Suchgebühr. Deep-Research-Modelle berechnen zusätzlich zu den Token etwa 10 US-Dollar pro 1.000 Websuchaufrufe, und die Suchvorgänge können nicht ausgeschaltet werden – die autonome Suche ist das Ergebnis. Fünfzehn Suchvorgänge kosten 0,15 US-Dollar pro Abfrage, bevor ein einzelner Token gezählt wird. Das bedeutet, dass für kurze Abfragen eine harte Preisuntergrenze gilt und Preisvergleichstabellen pro Token systematisch unterschätzen, was eine gründliche Recherche tatsächlich kostet. Bei kurzen Anfragen können die Recherchegebühren die Token-Rechnung komplett übersteigen.
Der praktische Hebel ist die Etagenführung. o4-mini-deep-research erledigt Routinerecherchen – Wettbewerbsscans, strukturierte Zusammenfassungen, Faktenermittlung – zu etwa 3,5-mal weniger Aufwand pro Abfrage als o3-deep-research. Leiten Sie alles zuerst an die Mini-Stufe weiter und eskalieren Sie nur dort, wo die Berichtsqualität unzureichend ist: Bei 100 Abfragen pro Monat macht diese einzelne Routing-Entscheidung die Differenz zwischen etwa 41 und 145 US-Dollar aus und skaliert von dort aus linear. Wenn Sie nur gelegentliche Suchvorgänge in einer einzelnen Quelle statt vollständiger Rechercheschleifen benötigen, ist ein reguläres Modell mit dem Websuchtool noch günstiger – modellieren Sie es separat mit dem Kostenrechner für das LLM-Websuchtool.
Kosten für das LLM-WebsuchtoolReasoning-Token-KostenKosten für ComputernutzungsagentenVergleichen Sie über 300 KI-Modelle
So funktioniert dieser Rechner
Dieser Rechner schätzt die vollen pro Abfrage und die monatlichen Kosten einer Deep Research API-Arbeitslast für beide o3-tiefe Forschung oder o4-Mini-Tiefenforschung. Es vereint drei Treiber in einer Zahl: dem Eingabe-Tokens Sie senden, der Preis entspricht dem von Ihnen eingegebenen Dollar-pro-Millionen-Satz; Die Argumentations- und Ausgabetoken das Modell generiert, während es forscht; und das Obligatorische Gebühren für die Websuche pro tausend Anrufe berechnet. Sie legen das Modell, das monatliche Abfragevolumen, den Eingabepreis und die Suchgebühr fest und es skaliert eine einzelne Abfrage auf eine monatliche Gesamtsumme, sodass Suchgebühren und Tokengebühren modelliert werden zusammen statt isoliert.
Der wichtigste Nachteil besteht darin, dass umfassende Rechercheabfragen suchintensiv sind, sodass die Suchgebühr häufig mit den Tokenkosten mithalten oder diese sogar übersteigt. Da o3-Deep-Research aggressiver begründet und sucht als o4-Mini-Deep-Research, können mit dem günstigeren Modell sowohl die Token- als auch die Suchausgaben für Routinefragen gesenkt werden. Betrachten Abfragevolumen am ehesten, da die Recherchegebühren linear skalieren und dazu tendieren dominieren bei hohen Monatszahlen.
Häufig gestellte Fragen
Wie viel kostet eine Deep Research API-Abfrage?
Eine realistische Forschungsaufgabe – Wettbewerbsanalyse, Marktforschung, Literaturrecherche – verbraucht typischerweise etwa 50.000 Eingabe-Tokens, 20.000 Ausgabe-Tokens (einschließlich versteckter Argumentation) und etwa 15 Websuchaufrufe. Bei o4-Mini-Deep-Research (2 $/Mio. Input, 8 $/Mio. Output) liegt das bei etwa 0,41 $ pro Suchanfrage: etwa 0,10 $ Input, 0,16 $ Output und 0,15 $ Websuchgebühren bei 10 $ pro 1.000 Aufrufe. Die gleiche Aufgabe bei o3-deep-research (10 $/Mio. Input, 40 $/Mio. Output) kostet etwa 1,45 $ – etwa das 3,5-fache. Kurze Abfragen kosten weniger, aber die Suchgebühren legen eine Untergrenze für jede Abfrage fest, unabhängig von der Länge.
Warum kann ich die Gebühren für die Websuche nicht deaktivieren?
Die Websuche macht ein Deep-Research-Modell zu einem Deep-Research-Modell – die API führt ihre eigenen Suchvorgänge als Teil der Forschungsschleife durch, und diese Aufrufe berechnen zusätzlich zu den Token-Kosten etwa 10 US-Dollar pro 1.000 Suchvorgänge. Im Gegensatz zum optionalen Websuchtool bei regulären Chat-Modellen suchen Deep-Research-Modelle autonom und die Anrufe können nicht deaktiviert werden. Bei kurzen Suchanfragen können die Suchgebühren den größten Einzelposten ausmachen: 15 Suchanfragen kosten 0,15 US-Dollar, bevor ein einzelner Token in Rechnung gestellt wird, weshalb Preisvergleiche pro Token allein die Kosten für umfassende Recherchen unterschätzen.
Soll ich o3-deep-research oder o4-mini-deep-research verwenden?
o4-mini-deep-research kostet etwa 3-4x weniger pro Abfrage (2 $/8 $ pro Million Token gegenüber 10 $/40 $) und erledigt die meisten routinemäßigen Rechercheaufgaben – Zusammenfassungen, Wettbewerbsscans, strukturierte Faktenermittlung. o3-deep-research ist das Flaggschiff für wirklich harte Synthesearbeit, bei der die Analysetiefe die Zahlung mehrerer Dollar pro Abfrage rechtfertigt. Ein gängiges Produktionsmuster besteht darin, alles zuerst an o4-mini weiterzuleiten und nur die Abfragen zu eskalieren, bei denen sich der günstigere Bericht als unzureichend erweist – bei typischen Arbeitslasten ändert diese Routing-Entscheidung die monatliche Rechnung um das 3,5-fache.