Publicado 2026-08-12 · números de referencia, verificar antes de presupuestar
Ejecute el mismo trabajo de moderación de contenido (150 tokens de entrada de contexto, una etiqueta de 5 tokens en el otro extremo) a través de nueve modelos "baratos" diferentes y la factura mensual oscilará entre $ 59,50 y $ 1750. Mismo trabajo, mismo volumen, mismo resultado. Una extensión de 29 veces, y cada uno de estos nueve modelos se le presenta como "la opción económica" dependiendo de los documentos del proveedor que esté leyendo.
Extraído de nuestra tabla de precios rastreada (387 modelos): cada modelo tiene un precio inferior a $1/1 millón de tokens de entrada que un proveedor comercializa actualmente para tareas de gran volumen y baja latencia: clasificación, extracción, moderación, enrutamiento. 10 millones de llamadas al mes, 150 tokens de entrada y 5 tokens de salida cada uno, por lo que 1.500 millones de tokens de entrada y 50 millones de tokens de salida en total.
| Modelo | Proveedor | Entrada /1M | Salida /1M | Mensual (10 millones de llamadas) |
|---|---|---|---|---|
| Nova Micro | Amazonas | $0.035 | $0.14 | $59.50 |
| Ministral 3B | Mistral | $0.040 | $0.04 | $62.00 |
| Comando R7B | Adherirse | $0.0375 | $0.15 | $63.75 |
| Géminis 3.1 Flash-Lite | $0.050 | $0.20 | $85.00 | |
| GPT-5 nano | AbiertoAI | $0.100 | $0.40 | $170.00 |
| GPT-4.1 nano | AbiertoAI | $0.100 | $0.40 | $170.00 |
| GPT-4o mini | AbiertoAI | $0.150 | $0.60 | $255.00 |
| Claude Haiku 3.5 | antrópico | $0.800 | $4.00 | $1,400.00 |
| Claude Haiku 4.5 | antrópico | $1.000 | $5.00 | $1,750.00 |
| Precios de referencia de nuestra mesa con orugas, 387 modelos. Ejemplo resuelto: 10 millones de llamadas/mes × 150 entradas + 5 tokens de salida. Ponle precio a tu propio volumen en el calculadora de costos de clasificación. | ||||
Nova Micro, Ministral 3B y Command R7B tienen una diferencia del 7% entre sí y ninguno de ellos es un nombre familiar en esta lista. Los dos nano SKU de OpenAI se ubican en casi 3x Nova Micro. GPT-4o mini, probablemente el modelo "barato" más buscado sólo por el reconocimiento de marca, ya es 4,3x Nova Micro. Y la línea Haiku de Claude, comercializada como el nivel económico de Anthropic, tiene un precio más cercano al de algunos modelos de chat de nivel medio que a cualquier otra cosa en esta tabla: 29,4x Nova Micro en entrada, 35,7x en salida.
Cada proveedor ofrece un modelo económico porque cada proveedor necesita una respuesta a "¿qué hago con mil millones de llamadas al mes?". Pero lo barato está en relación con el buque insignia de cada proveedor, no con el mercado. La brecha entre el buque insignia de Anthropic y Haiku y la brecha entre el buque insignia de Amazon y Nova-Micro son descuentos reales dentro de sus propios catálogos; simplemente no comienzan desde el mismo lugar. Nova Micro fue construido por un proveedor de nube que también vende la computación que contiene, por lo que el precio del modelo puede acercarse más al costo marginal. Claude Haiku hereda la gravedad de los precios al estar posicionado junto a Sonnet y Opus, donde "10 veces más barato que nuestro buque insignia" todavía cuesta 1/1 millón de dólares porque el buque insignia en sí es caro.
Nada de esto significa que Haiku sea un mal modelo para un trabajo de clasificación: con frecuencia es el más preciso y vale la pena pagar por la precisión cuando una etiqueta incorrecta cuesta más que la diferencia simbólica. Significa que "nivel de presupuesto" es una afirmación sobre la propia línea de un proveedor, no una afirmación sobre el mercado, y las dos se combinan constantemente en las páginas de precios y en los hilos de comparación.
Para una tarea realmente de gran volumen y baja complejidad (filtrado de spam, enrutamiento de intenciones, detección de PII, etiquetado de opiniones), comience con Nova Micro, Ministral 3B o Command R7B como precio mínimo, no con cualquier marca para la que ya tenga una clave API. Ejecute una verificación de precisión real de sus datos etiquetados antes de comprometerse; una diferencia de precios de 29x solo es una buena operación si la tasa de error del modelo barato no consume los ahorros en costos posteriores (tickets mal enrutados, indicadores de moderación omitidos, malas extracciones que necesitan revisión humana). Si la precisión en su tarea específica no se mantiene por debajo de GPT-4o mini o Haiku, ese es el precio real de la tarea: no $59.50, ni $1,750 por defecto tampoco. Ponle precio a tu propia combinación de tokens y volumen en el calculadora de costos de clasificación o el calculadora de costos de moderación de contenidoy comparar alineaciones completas en el página API LLM más barata.
Metodología: precios de nuestra tabla de precios rastreada (387 modelos) a partir de agosto de 2026, que coinciden con las tarifas publicadas por cada millón de tokens. El ejemplo trabajado utiliza una proporción de tokens construida de 150 entradas/5 salidas típica de llamadas de clasificación cortas, no telemetría de un sistema de producción: confirme la combinación de tokens de su propia carga de trabajo y la tarifa actual de cada proveedor antes de realizar el presupuesto.