HomeBlog › La deflación de precios de LLM y su presupuesto

Su presupuesto de IA probablemente sea incorrecto: los precios de LLM caen aproximadamente 10 veces al año

Publicado 2026-07-11 · basado en nuestra nueva Rastreador del historial de precios de LLM - todos los eventos de precios importantes desde GPT-4, con fechas

Recopilamos todos los cambios importantes en el precio de la API LLM desde marzo de 2023 hasta hoy en uno línea de tiempo. El patrón es más consistente de lo que esperábamos y rompe la mayoría de las hojas de cálculo de presupuesto de IA que hemos visto: a capacidad constante, los precios caen aproximadamente 10 veces por año. No gradualmente, sino en pasos y, por lo general, desde direcciones que nadie predijo.

Tres números que cuentan la historia

FechaInsumos de clase frontera, $/1 millónvs lanzamiento de GPT-4
Marzo de 2023 (GPT-4)$30.00
Agosto de 2024 (GPT-4o después del corte)$2.50−92%
2026 (anfitriones de peso abierto)<$1.00−97%

Precios de lista históricos. Cronología completa con 14 eventos fechados en el página de historial de precios.

El mecanismo importa: los modelos individuales rara vez son más baratos (los dos cortes del GPT-4o fueron la excepción). Lo que realmente sucede es reemplazo — cada nueva generación se envía en el nivel inferior de la generación anterior. El GPT-4o mini superó al GPT-3.5 Turbo a un tercio de su precio. DeepSeek V2 ofreció una calidad cercana a la frontera a 0,14 dólares. No se aprovecha la deflación esperando descuentos; lo montas volviendo a comprar el nivel.

lo que esto rompe

Contratos anuales a precios actuales. Un descuento por volumen del 30% fijado durante 12 meses es una pérdida si los precios de mercado caen entre un 60% y un 90% en ese período (y históricamente así ha sido). Cualquier valor superior a un compromiso de 6 a 12 meses es una apuesta contra una tendencia de tres años. Si debe comprometerse, comprométase a gastar, no a la hoja de tarifas de un modelo específico.

Decisiones de "la IA es demasiado cara para esta característica". Una función que cuesta hoy 10.000 dólares al mes probablemente cueste entre 1.000 y 3.000 dólares con la misma calidad dentro de 18 meses. La economía de unidades marginales hoy por lo general significa pronto una buena economía de unidades: el cálculo de construcción versus espera debería incluir la curva, no sólo la etiqueta de hoy.

Integración profunda de un solo proveedor. Ambos shocks de precios discontinuos en nuestra línea de tiempo (mayo de 2024, enero de 2025) provinieron de DeepSeek, un outsider. Los equipos con enrutamiento independiente del proveedor capturaron esos precios en días; Los equipos soldados a un SDK observaron desde el margen. El coste de ingeniería de una capa de abstracción es una prima de seguro ante el próximo shock.

Lo que NO dice la tendencia

Dos advertencias honestas a partir de los datos. Primero, Los precios de producción caen más lentamente. — GPT-4 lanzado con salida a 2× entrada; hoy en día, las proporciones de 4 a 5 × son estándar. Las cargas de trabajo con muchos resultados (generación de código, respuestas largas) se desinflan significativamente más lentamente que el titular. Segundo, los precios aumentan: Claude 3.5 Haiku se lanzó a 3,2 veces el precio de su predecesor porque se comparó como un modelo de nivel medio. Que el nivel barato se mantenga barato es un hábito, no una garantía; nunca lo codifiques.

La rutina práctica

Trimestralmente, quince minutos: pon tu mezcla de fichas real en el Comparación de más de 300 modelos y comprueba si tu modelo actual aún gana su nivel. Cuando no es así, el calculadora de ahorro por caída de precio pone precio a la migración. La mayoría de los equipos que modelamos obtienen entre un 30% y un 60% de ahorro la primera vez que hacen esto: dinero que estaba sobre la mesa simplemente porque la elección del modelo se hizo hace dos trimestres.

Todas las cifras son precios de lista históricos, compilados en julio de 2026: detalles y fuentes sobre el página de historial de precios. Relacionado: Comparación de precios de modelos de IA · Ahorros en rutas de modelos · API LLM más barata.