Home › Blog › GPT-6.1 Sol und GPT-6 Luna Preisgestaltung

GPT-6.1 Sol und GPT-6 Luna: Die neue OpenAI-Stufe, die noch niemand bepreist hat (2026)

6. Oktober 2026 · AI & LLMs · 5 Minuten Lesezeit

Hier sind die Details, die mich dazu veranlasst haben, anzuhalten und die Zahlen zweimal zu überprüfen: GPT-6.1 Sol kostet $ 2 pro Million Eingabe-Token und $ 10 pro Million Ausgabe. GPT-5.6 Sol — das Modell, nach dem es benannt ist, auf das OpenAI noch bis mindestens 21. November einen "Rabatt" gewährt — kostet derzeit $4/$20, auch wenn dieser Rabatt angewendet wird. Das neue Modell kostet die Hälfte der Freigaberate des alten Modells. Niemand startet versehentlich eine Stufe der nächsten Generation, die im Rahmen des Feuerverkaufs der letzten Generation angeboten wird.

Was tatsächlich ausgeliefert wurde

GPT-6 Astra stand im Rampenlicht, als es am 3. September für 10 $/50 $ pro Million Token auf den Markt kam. Unauffällig darunter ausgefüllt: GPT-6.1 Sol Und GPT-6 Luna, die beide diese Woche auf der OpenAI-eigenen Preisseite bestätigt wurden. Standard (Kurzkontext) -Raten, pro Million Token:

ModellEingangAusgabeim Vergleich zu GPT-5.6-Äquivalent
GPT-6 Astra$10.00$50.002,5× GPT-5,6 Sol's Abzinsungssatz
GPT-6.1 Sol$2.00$10.0050% günstiger als GPT-5.6 Sols eigene $ 4/$ 20 Aktion
GPT-6 Luna$0.10$0.50wie GPT-5.6 Lunas Preisanpassung im Juli

So ist die Familie keine saubere „alles kostet mehr“ Auffrischung. Astra ist das teure neue Flaggschiff. Luna blieb flach. Sol wurde — seltsamerweise — bei der Ankunft billiger als das Modell, das es ersetzt, Rabatt inbegriffen. Wenn Sie immer noch gegen den Aufkleberpreis von GPT-5.6 Sol budgetieren, zahlen Sie grundlos zu viel. Wenn Sie gegen den temporären Rabatt budgetieren, werden Sie angenehm überrascht sein, wenn dieser Rabatt abläuft und GPT-6.1 Sol immer noch zum halben Preis verfügbar ist.

Die 272K-Token-Klippe

Alle drei neuen Level haben die gleiche strukturelle Eigenart, und es ist die Art von Dingen, die erst auftauchen, wenn eine echte Arbeitsbelastung eintritt: 272.000 Eingabe-Token auf einen einzigen Antrag und die Produktinformationen anfrage — nicht nur die Überschreitung — wird mit einem höheren Satz abgerechnet. Input verdoppelt sich ungefähr, Output steigt um 50%:

Modell≤272.000 Token (in/out)>272.000 Token (in/out)
GPT-6 Astra$10.00 / $50.00$20.00 / $75.00
GPT-6.1 Sol$2.00 / $10.00$4.00 / $15.00
GPT-6 Luna$0.10 / $0.50$0.20 / $0.75

Ich schrieb über den gleichen Mechaniker auf Grok 4.7s 200K-Token-Klippe letzten Monat — dies ist der zweite große Anbieter, den ich gefunden habe, der eine Neuausrichtung der gesamten Anfrage anstelle einer Überschreitung pro Token durchführt. Es wird zu einem Muster, das es wert ist, entworfen zu werden, und nicht zu einem einmaligen.

Was das bei einem echten Dokumentenauftrag kostet

Angenommen, Sie betreiben eine Dokumentenanalyse-Pipeline: 500.000 Eingabe-Token pro Dokument (bis weit in den Langzeitkontext), 5.000 Token für die zusammenfassende Ausgabe. Pro Anfrage:

ModellKosten pro Anfrage2.000 Anfragen/Monat
GPT-6 Astra$10.375$20,750
GPT-6.1 Sol$2.075$4,150
GPT-6 Luna$0.104$208

Gleiches Dokument, gleiche Pipeline, gleicher Monat: 20.750 $ oder 208 $, je nachdem, auf welche Stufe Sie standardmäßig setzen — ein 100-facher Spread für die Ausgabequalität, der sich nicht 100-fach unterscheidet. Für einen kurzen Austausch im Chat-Stil (2.000 Eingabe- / 500 Ausgabe-Token, nirgendwo in der Nähe der Klippe) ist die Lücke relativ gesehen genauso real: Astra läuft $ 0,045 pro Runde, GPT-6.1 Sol $ 0,009, Luna unter einem halben Cent. Bei Chatbot-Volumen — sagen wir 200.000 Umdrehungen pro Monat — sind das 9.000 $ bei Astra im Vergleich zu 1.800 $ bei Sol im Vergleich zu 90 $ bei Luna.

Was ich eigentlich tun würde

Default to Luna. Seriously — $0.10/$0.50 is cheap enough that most classification, extraction and routing tasks should never see Astra's rate card. Reserve Astra for the subset of requests that actually need its reasoning depth, and route everything else down. If your pipeline ever touches documents near 272K tokens, don't let it happen by accident: chunk or summarize before the line on purpose, the same advice I gave for Grok's 200K cliff, because crossing it silently doubles your input cost on the whole request, not just the tail end. And if you're still pricing against GPT-5.6 Sol because that's what's in your code — check again. Its $4/$20 rate is explicitly temporary (through at least Nov 21), and GPT-6.1 Sol already beats it on a rate that isn't going anywhere.

Neu bei der nutzungsbasierten LLM-Preisgestaltung? Beginnen Sie mit der kostenlose API-Kostenleitfäden. Für den anderen Anbieter, der die gesamte Anforderungs-Klippenpreisgestaltung durchführt, siehe Grok 4.7s 200K-Token-Klippe.

Die Preise wurden am 6. Oktober 2026 anhand der offiziellen API-Preisseite von OpenAI überprüft und mit der unabhängigen Berichterstattung abgeglichen. Referenzschätzungen — Bestätigen Sie die aktuelle Preisgestaltung und Ihren tatsächlichen Token-Mix vor der Budgetierung.