—por llamada
—por cada mil llamadas
—nivel más barato
Niveles GPT-5: misma carga de trabajo
Tokens idénticos y volumen de llamadas, con precios en cada nivel GPT-5. Se destaca el más económico para esta carga de trabajo.
| Nivel | Ingrese $/1 millón | Producción $/1 millón | Costo / mes |
|---|
⚠️ Precio de referencia de GPT-5 (2026): GPT-5.5 $5,00/$30,00, GPT-5 $1,25/$10,00, GPT-5 mini $0,40/$1,60, GPT-5 nano $0,10/$0,40 por 1 millón de tokens de entrada/salida. Los precios cambian y varían según el nivel, la región, el lote y la entrada en caché; confírmelo en la página de precios de OpenAI. ¿Quieres todos los modelos uno al lado del otro? Utilice el
comparación completa de precios de LLM o el
calculadora de costo simbólico. ·
Informar precio desactualizado →
✓ Última verificación: 2026-07-24· Fuente: página oficial de precios del proveedor.· Supervisado automáticamente — reportar cambio →
Cómo funcionan los precios de la API GPT-5
GPT-5 se factura por token, dividido en aporte (su mensaje más cualquier contexto que envíe) y producción (todo lo que el modelo escribe). En cada nivel, la producción cuesta varias veces más que la entrada: GPT-5 es $1.25 / 1 millón de entrada y $10.00 / 1 millón de producción, una brecha de 8×, por lo que la longitud de la respuesta es el factor más importante en su factura. tapado max_tokens, solicita respuestas concisas y el sistema de recorte incita a todos a reducir costos directamente. Debido a que GPT-5 es un modelo de razonamiento, los tokens de razonamiento ocultos que genera antes de la respuesta final también se facturan como resultado, por lo que aparece un razonamiento pesado paso a paso en la factura incluso cuando la respuesta visible es corta.
La segunda palanca es elección de nivel. La familia abarca una amplia gama de precios: buque insignia GPT-5.5 a $5,00 / $30,00 por el razonamiento más arduo y el trabajo más extenso, GPT-5 como el valor predeterminado equilibrado, GPT-5 mini a aproximadamente un tercio del precio de GPT-5 para tareas cotidianas, y GPT-5 nano a $0,10/$0,40 para clasificación, extracción y respuestas breves de gran volumen. Un patrón común es ejecutar un nivel más económico de forma predeterminada y reservar GPT-5 o GPT-5.5 solo para las solicitudes que realmente necesitan calidad de vanguardia; la tabla anterior muestra exactamente lo que cuesta cada nivel en su volumen. Para ver GPT-5 contra Claude, Gemini y el resto, usa el Comparación de precios de LLM; para obtener un desglose desde cero de cómo se suma la facturación por token, lea cómo funcionan los precios de LLM API o navegar por el Centro de aprendizaje.
Cómo funciona esta calculadora
Calcule el costo de la API de GPT-5 a partir de sus tokens de entrada/salida y el volumen de llamadas, consulte la factura mensual y el costo por llamada, y compare GPT-5.5, GPT-5, GPT-5 mini y GPT-5 nano en la misma carga de trabajo para que pueda elegir el nivel más barato que aún hace el trabajo.
Preguntas frecuentes
¿Cuánto cuesta la API GPT-5?
El precio de referencia (2026) es GPT-5 a 1,25 dólares por millón de tokens de entrada y 10,00 dólares por millón de tokens de salida. El modelo insignia GPT-5.5 cuesta $ 5,00 de entrada / $ 30,00 de salida, mientras que el GPT-5 mini cuesta $ 0,40 / $ 1,60 y el GPT-5 nano cuesta $ 0,10 / $ 0,40. Su factura son los tokens de entrada multiplicados por el precio de entrada más los tokens de salida multiplicados por el precio de salida, multiplicado por la cantidad de llamadas que realiza.
¿Cuál es la diferencia entre GPT-5, GPT-5 mini y GPT-5 nano?
Son la misma familia con diferentes capacidades y precios. GPT-5 y GPT-5.5 son los niveles fronterizos para el razonamiento arduo y el trabajo prolongado; GPT-5 mini es aproximadamente 3 veces más barato que GPT-5 para las tareas cotidianas; GPT-5 nano es el más barato y está destinado a clasificación, extracción y respuestas breves de gran volumen. Haga coincidir el nivel con la tarea en lugar de utilizar de forma predeterminada el modelo superior.
¿Por qué la salida GPT-5 es más cara que la entrada?
En cada nivel de GPT-5, el precio de producción (por millón) es varias veces el precio de entrada. Los tokens de razonamiento que genera el modelo antes de su respuesta final también se facturan como resultado, por lo que las respuestas detalladas y el razonamiento intenso son los que generan la factura. Limitar max_tokens y pedir respuestas concisas reduce los costos directamente.