Cómo funcionan los precios de la API de LLM

Tokens, entrada versus salida, ventanas de contexto: por qué la misma tarea puede costar 50 veces más en un modelo que en otro, explicado de forma sencilla.

HogarModelos de IA › Géminis 3.1 Pro frente a Géminis 2.5 Flash

Gemini 3.1 Pro vs Gemini 2.5 Flash: comparación de precios

Precios reales de API de 2026 uno al lado del otro, con el costo total de una carga de trabajo mensual típica de 10 millones de entradas/3 millones de salidas.

Precio y coste de un vistazo

Géminis 3.1 ProGéminis 2.5 Flash
Entrada / 1 millón de tokens$2$0.3
Salida / 1 millón de tokens$12$2.5
ventana contextual2000K1000K
Costo: 10 millones de entrada + 3 millones de salida$56$10.5

Verde = más barato/más grande. Precios por 1 millón de tokens, USD. Instantánea 2026: verifique con el proveedor.

¿Cuál es más barato?

Géminis 2.5 Flash es la opción más económica en una carga de trabajo de 10 millones de entradas/3 millones de salidas: alrededor de $10,5/mes frente a $56 para Gemini 3.1 Pro (~5,3 veces la diferencia). Debido a que los tokens de salida se facturan más alto, el modelo con el menor producción El precio generalmente gana a medida que sus respuestas se hacen más largas.

Ejecute su propia mezcla de tokens en el calculadora de costos, o ver cada modelo en profundidad: Géminis 3.1 Pro · Géminis 2.5 Flash.

Preguntas frecuentes

¿Es más barato Gemini 3.1 Pro o Gemini 2.5 Flash?

Con una cantidad típica de 10 millones de tokens de entrada + 3 millones de salida por mes, Gemini 2.5 Flash cuesta alrededor de $ 10,5 frente a $ 56 de Gemini 3.1 Pro; Gemini 2.5 Flash es aproximadamente 5,3 veces más barato en esta carga de trabajo. Su proporción de tokens de entrada y salida cambia la brecha.

¿Cuál es la diferencia de precio entre Gemini 3.1 Pro y Gemini 2.5 Flash?

Gemini 3.1 Pro cuesta $2/$12 por 1 millón de tokens de entrada/salida; Gemini 2.5 Flash cuesta $0.3/$2.5. Los tokens de salida suelen dominar un billete, así que primero compare el precio de salida.

¿Cuál tiene la ventana de contexto más grande, Gemini 3.1 Pro o Gemini 2.5 Flash?

Gemini 3.1 Pro admite alrededor de 2000.000 tokens y Gemini 2.5 Flash alrededor de 1.000.000. Una ventana más grande cuesta más por llamada porque se factura cada token en contexto.

Estimaciones educativas: no afiliado a ningún proveedor.