HomeBlog › Costo del host de inferencia de modelo abierto

Mismo modelo, factura diferente: cuánto cuestan los LLM abiertos en 6 hosts de inferencia

Publicado 2026-08-06 · números de referencia, verificar antes de presupuestar

DeepSeek V4 es DeepSeek V4. Los pesos son idénticos ya sea que lo llames Groq, Juntos, Fuegos artificiales, DeepInfra, Novita o enrutador abierto — misma arquitectura, misma calidad de salida, sin diferencias de ajuste entre hosts. Lo que no es idéntico es la factura. Hemos reducido nuestro precio por 1 millón de tokens en los seis para exactamente el mismo modelo, dos veces, y la brecha entre el host más barato y el más caro se sitúa en un nivel constante. 31% - cada vez.

La carga de trabajo que estamos valorando

Un RAG de tamaño mediano o un backend de asistente de codificación en ejecución Búsqueda profunda V4: 50 millones de tokens de entrada y 10 millones de tokens de salida al mes. Se trata de un rango de producción real: un robot de soporte o una herramienta de codificación interna con unos cientos de usuarios activos, no un proyecto de juguete.

Paso 1: DeepSeek V4, seis hosts

AnfitriónEntrada / 1MSalida / 1MCosto mensual
novita$0.216$0.88$19.60
Infraestructura profunda$0.2295$0.935$20.83
Groq$0.2565$1.045$23.28
Juntos$0.27$1.10$24.50
enrutador abierto$0.27$1.10$24.50
Fuegos artificiales$0.2835$1.155$25.73

Los precios son estimaciones de referencia, agosto de 2026. Informar precio desactualizado →

$ 19,60 a $ 25,73 con pesos idénticos para uso idéntico: un $6.13/mes, brecha del 31% con cero diferencia de calidad para explicarlo. A 10 veces el volumen (500 millones de entrada/100 millones de salida, un producto realmente ocupado) eso es $196 frente a $257, a $735/año diferencia del menú desplegable de host solo.

Paso 2: Llama 4 Maverick, los mismos seis anfitriones

Para comprobar que esto no era una peculiaridad de DeepSeek, ejecutamos los mismos seis hosts contra Llama 4 Maverick en la misma carga de trabajo de 50M/10M:

AnfitriónEntrada / 1MSalida / 1MCosto mensual
novita$0.28$0.92$23.20
Infraestructura profunda$0.2975$0.9775$24.65
Groq$0.3325$1.0925$27.55
Juntos$0.35$1.15$29.00
enrutador abierto$0.35$1.15$29.00
Fuegos artificiales$0.3675$1.2075$30.45

Mismo ranking, mismo orden, mismo 31% de difusión desde Novita en la parte inferior hasta Fireworks en la parte superior. Eso no es una coincidencia: es un multiplicador fijo que cada host aplica al mismo precio de referencia, y se mantiene en todos los modelos abiertos que verificamos en nuestro conjunto de precios, desde el parámetro 12B Gemma hasta el parámetro 400B+ Llama 4 Behemoth.

De dónde viene la banda del 31%

Lo que esto no te dice

La paridad de precios entre modelos no significa que los hosts sean intercambiables. Estamos comparando únicamente la tasa por token, no la latencia, el historial de tiempo de actividad, la cobertura regional, los límites de velocidad o cómo se comporta cada host ante un pico de tráfico. Un descuento del 20% en Novita no vale nada si un robot de soporte se agota durante su hora más ocupada. Si está preocupado por los ingresos y los costos, comience con el host más barato y un respaldo. Si ya tiene un volumen significativo, compare la latencia y el tiempo de actividad de su propio tráfico antes de cambiar únicamente en la columna de precios: la brecha de $735/año de nuestro ejemplo es dinero real, pero no es el único número que importa.

la comida para llevar

Peso abierto no significa precios abiertos. El hecho de que el modelo se pueda descargar de forma gratuita no impide que seis empresas diferentes cobren seis tarifas diferentes para ejecutarlo por usted, y la difusión... 31% de arriba a abajo, en el mismo orden, en todos los modelos que verificamos – es lo suficientemente grande como para importar una vez que se superan unos pocos millones de tokens al mes. Antes de comprometerse con un host, ejecute su propio volumen de token a través del la herramienta API LLM más baratay compare los proveedores directamente en sus páginas: Groq, Juntos, Fuegos artificiales, enrutador abierto. Es la misma lección que El impuesto en frontera entre los niveles del modelo.: el nombre del modelo en la factura dice menos que el logotipo del proveedor al lado.

Las cifras son estimaciones de referencia (agosto de 2026) de nuestro propio conjunto de datos de precios. Los precios del host de inferencia cambian con frecuencia y los descuentos por volumen, las tarifas por uso comprometido y los precios regionales pueden cambiar la clasificación; siempre confirme las tarifas actuales en la página oficial de precios de cada proveedor antes de realizar el presupuesto.