So funktioniert die LLM-API-Preisgestaltung

Tokens, Eingabe vs. Ausgabe, Kontextfenster – warum die gleiche Aufgabe bei einem Modell 50-mal mehr kosten kann als bei einem anderen, einfach erklärt.

HeimKI-Modelle › o4 vs. o3

o4 vs. o3: Preisvergleich

Echte API-Preise für 2026 nebeneinander, mit den Gesamtkosten einer typischen monatlichen Arbeitslast von 10 Millionen Inputs und 3 Millionen Outputs.

Preis & Kosten auf einen Blick

o4o3
Eingabe / 1 Mio. Token$4$2
Ausgabe / 1 Mio. Token$16$8
Kontextfenster200.000200.000
Kosten: 10 Mio. rein + 3 Mio. raus$88$44

Grün = günstiger / größer. Preise pro 1 Mio. Token, USD. Schnappschuss 2026 – Rücksprache mit dem Anbieter.

Was ist günstiger?

o3 ist die günstigere Option bei einem Workload von 10 Mio. Ein- und 3 Mio. Ausgängen – etwa 44 $/Monat gegenüber 88 $ für o4 (~2,0-facher Unterschied). Da die Ausgabetokens höher berechnet werden, ist das Modell mit den niedrigeren Werten in Rechnung gestellt Ausgabe Der Preis gewinnt normalerweise, wenn Ihre Antworten länger werden.

Führen Sie Ihren eigenen Token-Mix im aus Kostenrechner, oder sehen Sie sich jedes Modell im Detail an: o4 · o3.

Häufig gefragt

Ist o4 oder o3 günstiger?

Bei typischen 10 Mio. Input- und 3 Mio. Output-Tokens pro Monat kostet o3 etwa 44 US-Dollar gegenüber 88 US-Dollar für o4 – o3 ist bei dieser Arbeitslast etwa 2,0-mal günstiger. Ihr Verhältnis von Input- zu Output-Token verändert die Lücke.

Was ist der Preisunterschied zwischen o4 und o3?

o4 beträgt 4 $/16 $ pro 1 Mio. Eingabe-/Ausgabe-Tokens; o3 ist 2 $/8 $. Output-Token dominieren in der Regel eine Rechnung, vergleichen Sie also zuerst den Output-Preis.

Welches hat das größere Kontextfenster, o4 oder o3?

o4 unterstützt etwa 200.000 Token und o3 etwa 200.000. Ein größeres Fenster kostet mehr pro Anruf, da jedes Token im Kontext in Rechnung gestellt wird.

Bildungsschätzungen – keine Verbindung zu irgendeinem Anbieter.