Publicado 2026-06-30 · precios de referencia, verificar antes de presupuestar
La guerra de precios del LLM de 2026 tiene una nueva forma: Grok de xAI ha entrado en la conversación como líder de costos, OpenAI y Google se han dividido en niveles claros de presupuesto y premium, y Claude de Anthropic todavía se encuentra en la cima de la escala de precios. Para que la comparación sea honesta, hicimos lo que siempre hacemos: fijamos una carga de trabajo y le asignamos un precio en cada modelo principal. El trabajo: 1.000.000 de solicitudes, cada 1000 tokens de entrada y 500 tokens de salida (una típica charla breve o llamada generacional). Son mil millones de tokens de entrada y 500 millones de tokens de salida.
| Modelo | En $/1 millón | Salida $/1 millón | Costo por 1 millón de solicitudes |
|---|---|---|---|
| Grok 4.1 Rápido frontera más barata | $0.20 | $0.50 | $450 |
| Búsqueda profunda V3 | $0.27 | $1.10 | $820 |
| GPT-5.4 mini | $0.40 | $1.60 | $1,200 |
| Géminis 2.5 Flash | $0.30 | $2.50 | $1,550 |
| Géminis 3.1 Pro | $2.00 | $12.00 | $8,000 |
| GPT-5.4 | $2.50 | $15.00 | $10,000 |
| Grok 4 (buque insignia) | $3.00 | $15.00 | $10,500 |
| Claude Opus 4.6 | $5.00 | $25.00 | $17,500 |
Los precios son estimaciones de referencia, julio de 2026. Informar precio desactualizado →
Misma carga de trabajo, $450 en Grok 4.1 Fast versus $17,500 en Claude Opus 4.6 - a ~39× propagación. La decisión más importante en su factura de IA sigue siendo a qué modelo dirigirse, y en 2026 el extremo barato de la frontera se trasladó a xAI.
Grok fue agresivo con el precio. El nivel rápido de xAI a $0,20/$0,50 socava incluso a DeepSeek en términos de producción y se ubica muy por debajo de cualquier modelo de frontera occidental: una apropiación deliberada de tierras, junto con una enorme ventana de contexto y datos X en vivo. OpenAI y Google se bifurcaron. Cada uno tiene ahora un modelo pequeño realmente barato (GPT-5.4 mini, Gemini 2.5 Flash) y un modelo insignia caro (GPT-5.4, Gemini 3.1 Pro), entonces "¿cuál es más barato, OpenAI o Google?" Depende completamente de a qué nivel te refieres. Claude se mantuvo premium. Opus sigue siendo el más caro por token de las principales empresas: Anthropic valora la capacidad y la confiabilidad, no el liderazgo en costos. Si su presupuesto es una limitación, Claude Haiku (mucho más barato) es el nivel a considerar, no Opus.
El número que gane esta tabla no gana automáticamente su proyecto. Un modelo más barato que necesita un nuevo intento, escribe respuestas más largas o falla en preguntas difíciles puede costar más en la práctica que uno más caro que funciona a la primera. La longitud de la salida también importa: la salida se factura entre 2,5 y 5 veces la entrada en cada modelo aquí, por lo que un modelo barato y detallado puede perder frente a uno caro y conciso. El patrón que adoptan la mayoría de los equipos es niveles: enruta el tráfico de alto volumen y rutina a un modelo económico (Grok Fast, Gemini Flash, DeepSeek) y escala solo las solicitudes realmente difíciles a un modelo insignia. Incluso enviar el 20% de las llamadas a un modelo premium mantiene el costo combinado cerca del extremo económico de la tabla.
Una vez que se elige el modelo, tres cosas influyen en la factura: tapas de salida (colocar max_tokens — la producción es la mitad más cara), almacenamiento en caché rápido (las indicaciones repetidas del sistema se facturan con un gran descuento en OpenAI, Anthropic, Grok y DeepSeek), y enrutamiento (Lo barato primero, intensificar la incertidumbre). Cada uno se combina con los demás. Modele los ahorros con el calculadora de almacenamiento en caché rápida y el calculadora de enrutamiento de modelos.
Sus tokens no son nuestros, por lo que la clasificación puede cambiar según el tráfico con mucha salida o con mucha entrada. Conecte sus longitudes y volumen reales de entrada/salida al Clasificador API LLM más barato - clasifica cada modelo por su números - o el Calculadora de costos de API de IA. ¿Construyendo algo específico? Utilice el Estimador de costos de aplicaciones de IA, y si revende IA en una suscripción, el Calculadora de precios de contenedor de IA muestra si su precio realmente compensa el costo de API. Guías por proveedor: Grok, AbiertoAI, claudio, Géminis, búsqueda profunda.
Abra el ranking de API LLM más barato → · OpenAI vs Claude vs Géminis →
Precios de referencia (junio de 2026), recopilados de páginas públicas de precios y comparaciones de proveedores; Los nombres de los modelos y las tarifas cambian con frecuencia; verifique antes de presupuestar. No afiliado a ningún proveedor.