6 de octubre de 2026 · AI y LLM · 5 min de lectura
Este es el detalle que me hizo detenerme y comprobar los números dos veces: GPT-6.1 Sol cuesta $ 2 por millón de tokens de entrada y $ 10 por millón de salida. GPT-5.6 Sol — el modelo que lleva su nombre, el que OpenAI todavía está ejecutando un "descuento" hasta al menos el 21 de noviembre — actualmente cuesta $4/$20, incluso con ese descuento aplicado. El nuevo modelo tiene la mitad del precio de la tasa de liquidación del modelo anterior. Nadie lanza un nivel de próxima generación con un precio en la venta de última generación por accidente.
GPT-6 Astra tomó el centro de atención cuando se lanzó el 3 de septiembre a $ 10/$ 50 por millón de tokens. Rellenado silenciosamente debajo de él: GPT-6.1 sol y GPT-6 luna, ambos confirmados en la propia página de precios de OpenAI esta semana. Tarifas estándar (contexto corto), por millón de tokens:
| Modelo | Aporte | Producción | vs equivalente GPT-5.6 |
|---|---|---|---|
| GPT-6 Astra | $10.00 | $50.00 | 2.5× GPT-5.6 Tasa de descuento de sol |
| GPT-6.1 sol | $2.00 | $10.00 | 50% más barato que la promoción de $ 4/$ 20 de GPT-5.6 Sol |
| GPT-6 luna | $0.10 | $0.50 | igual que la revisión de precios de julio de GPT-5.6 Luna |
Así que la familia no es una actualización limpia de "todo cuesta más". Astra es el nuevo buque insignia caro. Luna se mantuvo plana. Sol, curiosamente, se hizo más barato a la llegada que el modelo al que reemplaza, con descuento incluido. Si todavía estás presupuestando contra el precio de etiqueta de GPT-5.6 Sol, estás pagando de más sin ninguna razón; si estás presupuestando contra su descuento temporal, estás a punto de sorprenderte gratamente cuando ese descuento caduque y GPT-6.1 Sol todavía esté allí a la mitad de la tasa.
Los tres nuevos niveles comparten la misma peculiaridad estructural, y es el tipo de cosa que no aparece hasta que una carga de trabajo real la alcanza: cruzar 272.000 tokens de entrada en una sola solicitud y el totalidad solicitud, no solo el excedente, se factura a una tarifa más alta. La entrada se duplica aproximadamente, la salida aumenta un 50%:
| Modelo | ≤272K fichas (entrada/salida) | >272K tokens (entrada/salida) |
|---|---|---|
| GPT-6 Astra | $10.00 / $50.00 | $20.00 / $75.00 |
| GPT-6.1 sol | $2.00 / $10.00 | $4.00 / $15.00 |
| GPT-6 luna | $0.10 / $0.50 | $0.20 / $0.75 |
Escribí sobre el mismo mecánico en Acantilado de 200K token de Grok 4.7 el mes pasado: este es el segundo proveedor importante que he encontrado que hace reprecios de solicitud completa en lugar de excedentes por token. Se está convirtiendo en un patrón que vale la pena diseñar, no un hecho aislado.
Digamos que está ejecutando una canalización de análisis de documentos: 500.000 tokens de entrada por documento (bien en territorio de contexto largo), 5.000 tokens de salida de resumen. Por solicitud:
| Modelo | Por solicitud | 2.000 solicitudes/mes |
|---|---|---|
| GPT-6 Astra | $10.375 | $20,750 |
| GPT-6.1 sol | $2.075 | $4,150 |
| GPT-6 luna | $0.104 | $208 |
El mismo documento, la misma canalización, el mismo mes: $ 20.750 o $ 208 dependiendo del nivel que elija por defecto: un margen de 100x para la calidad de salida que no difiere de 100x. Para un intercambio corto estilo chat (2,000 tokens de entrada / 500 de salida, ni cerca del acantilado), la brecha es igual de real en términos relativos: Astra cuesta $ 0.045 por turno, GPT-6.1 Sol $ 0.009, Luna menos de medio centavo. En el volumen del chatbot, digamos 200.000 vueltas al mes, eso es $ 9.000 en Astra frente a $ 1.800 en Sol frente a $ 90 en Luna.
Default to Luna. Seriously — $0.10/$0.50 is cheap enough that most classification, extraction and routing tasks should never see Astra's rate card. Reserve Astra for the subset of requests that actually need its reasoning depth, and route everything else down. If your pipeline ever touches documents near 272K tokens, don't let it happen by accident: chunk or summarize before the line on purpose, the same advice I gave for Grok's 200K cliff, because crossing it silently doubles your input cost on the whole request, not just the tail end. And if you're still pricing against GPT-5.6 Sol because that's what's in your code — check again. Its $4/$20 rate is explicitly temporary (through at least Nov 21), and GPT-6.1 Sol already beats it on a rate that isn't going anywhere.
¿Nuevo en los precios de LLM basados en el uso? Comience con el guías gratuitas de costos de API. Para el otro proveedor que hace precios de acantilado de solicitud completa, consulte Acantilado de 200K token de Grok 4.7.
Las tarifas se verificaron con la página oficial de precios de la API de OpenAI y se cotejaron con la cobertura independiente, el 6 de octubre de 2026. Estimaciones de referencia: confirme los precios actuales y su combinación de tokens real antes de presupuestar.