más barato capaz
más barato / mes
propagación insignia / mes

Tabla de precios completa: su carga de trabajo

Referencia de tokens de $/1 millón (julio de 2026), costo mensual según los números anteriores.

ProveedorModeloEn $/1 millónSalida $/1 millónCosto / mes

Más barato por caso de uso

⚠️ Precios de referencia, julio de 2026: los tres proveedores cambian los precios periódicamente. Confirme en la página de precios de cada proveedor. La producción se factura por separado y cuesta más que la entrada en cada modelo. · Informar precio desactualizado →
✓ Última verificación: 2026-08-15· Fuente: página oficial de precios del proveedor.· Supervisado automáticamente — reportar cambio →

Cómo elegir realmente

La lealtad a la marca es el hábito más caro en IA. Los tres proveedores se superan constantemente y la diferencia real de costos proviene de dos cosas que usted controla: el nivel de modelo tu eliges y como largas tus salidas son. Un modelo de frontera con respuestas breves puede ser más barato que un modelo "barato" con respuestas divagantes. Ponga precio a la carga de trabajo, no al logotipo: la tabla anterior hace exactamente eso según sus propios números.

Profundice en un proveedor con el Calculadora GPT-4o, el calculadora claudia o el Calculadora Géminis, compare todos los modelos a la vez en el calculadora completa de costos de API de IA, o estimar un producto completo con el Estimador de costos de aplicaciones de IA.

Tres palancas reducen aún más la factura una vez que haya elegido un modelo, y los tres proveedores ofrecen los tres. Almacenamiento en caché rápido cambia el precio de los mensajes y documentos repetidos del sistema a una fracción de la velocidad de entrada normal; vale la pena para cualquier aplicación que reenvía las mismas instrucciones o contexto en cada llamada; dimensionarlo en el calculadora de ahorro de almacenamiento en caché rápida. A API por lotes ofrece aproximadamente un 50 % de descuento para trabajos que pueden esperar unas horas en lugar de necesitar una respuesta en vivo; ver el calculadora de ahorro de API por lotes. Y para aplicaciones de gran volumen, enrutamiento Las solicitudes rutinarias de un modelo más barato y al mismo tiempo reservar el buque insignia para casos difíciles es a menudo la palanca más importante de todas: modelarlo según el Calculadora de costos de enrutador modelo AI.

Una diferencia más que no aparece en la tabla de precios: sólo Géminis tiene un nivel de API gratuito genuino (Google AI Studio, no se requiere tarjeta), lo que lo convierte en la forma más económica de crear prototipos antes de comprometerse. Tanto OpenAI como Anthropic requieren que se configure la facturación desde la primera solicitud, aunque las cuentas nuevas obtienen un crédito de prueba limitado.

Preguntas frecuentes

¿Cuál es más barato: OpenAI, Claude o Gemini? Para el modelo capaz más barato, Gemini 2.0 Flash ($0,10 / $0,40 por 1 millón de tokens) y GPT-4o mini ($0,15 / $0,60) lideran. Entre los buques insignia, Gemini 2.5 Pro tiene el precio de entrada más bajo, GPT-4o se encuentra en el medio y Claude Opus es el más caro; el ganador depende del nivel que necesita, no de la marca.

¿Claude es más caro que GPT-4o? Claude Sonnet 4 ($3 / $15) es un poco más caro que GPT-4o ($2,50 / $10), y Claude Opus 4 es mucho más caro, pero Claude Haiku 3.5 socava el GPT-4o. Compare la carga de trabajo que realmente ejecuta, ya que la longitud de salida domina la factura.

¿Los tres admiten el almacenamiento en caché rápido y los descuentos por lotes? Sí, los tres ofrecen almacenamiento en caché para solicitudes repetidas y una API por lotes a aproximadamente la mitad de precio. Los ahorros reales dependen de cuán repetitivas sean sus indicaciones y de si su trabajo puede tolerar el retraso del lote.

¿Alguno de los tres tiene un nivel de API gratuito? Gemini es el único: Google AI Studio ofrece acceso gratuito con límites de velocidad lo suficientemente generosos para la creación de prototipos. OpenAI y Anthropic requieren que primero se configure la facturación, aunque ambos otorgan crédito de prueba limitado a cuentas nuevas.