Cómo funcionan los precios de la API de LLM

Tokens, entrada versus salida, ventanas de contexto: por qué la misma tarea puede costar 50 veces más en un modelo que en otro, explicado de forma sencilla.

HogarModelos de IA ›GPT-5 nano frente a Gemini 3.1 Flash

GPT-5 nano vs Gemini 3.1 Flash: comparación de precios

Precios reales de API de 2026 uno al lado del otro, con el costo total de una carga de trabajo mensual típica de 10 millones de entradas/3 millones de salidas.

Precio y coste de un vistazo

GPT-5 nanoGéminis 3.1 Flash
Entrada / 1 millón de tokens$0.1$0.1
Salida / 1 millón de tokens$0.4$0.4
ventana contextual400K1000K
Costo: 10 millones de entrada + 3 millones de salida$2.2$2.2

Verde = más barato/más grande. Precios por 1 millón de tokens, USD. Instantánea 2026: verifique con el proveedor.

¿Cuál es más barato?

GPT-5 nano es la opción más económica en una carga de trabajo de 10 millones de entradas/3 millones de salidas: alrededor de $2,2/mes versus $2,2 para Gemini 3.1 Flash (~1,0× de diferencia). Debido a que los tokens de salida se facturan más alto, el modelo con el menor producción El precio generalmente gana a medida que sus respuestas se hacen más largas.

Ejecute su propia mezcla de tokens en el calculadora de costos, o ver cada modelo en profundidad: GPT-5 nano · Géminis 3.1 Flash.

Preguntas frecuentes

¿Es más barato GPT-5 nano o Gemini 3.1 Flash?

Con una cantidad típica de 10 millones de tokens de entrada + 3 millones de salida por mes, GPT-5 nano cuesta alrededor de $2,2 versus $2,2 para Gemini 3.1 Flash; GPT-5 nano es aproximadamente 1,0 veces más barato en esta carga de trabajo. Su proporción de tokens de entrada y salida cambia la brecha.

¿Cuál es la diferencia de precio entre GPT-5 nano y Gemini 3.1 Flash?

GPT-5 nano cuesta $0,1/$0,4 por 1 millón de tokens de entrada/salida; Gemini 3.1 Flash cuesta $0,1/$0,4. Los tokens de salida suelen dominar un billete, así que primero compare el precio de salida.

¿Cuál tiene la ventana de contexto más grande, GPT-5 nano o Gemini 3.1 Flash?

GPT-5 nano admite alrededor de 400.000 tokens y Gemini 3.1 Flash alrededor de 1000.000. Una ventana más grande cuesta más por llamada porque se factura cada token en contexto.

Estimaciones educativas: no afiliado a ningún proveedor.