HomeBlog › Costo de razonamiento de DeepSeek R1 vs o1 vs o3

DeepSeek R1 vs o1 vs o3: la prima de razonamiento no se redujo de manera uniforme

Publicado 2026-08-10 · números de referencia, verificar antes de presupuestar

Ejecute la misma carga de trabajo de cadena de pensamiento a través de o1 de OpenAI y costará 27 veces lo que cuesta DeepSeek R1. En su lugar, ejecútelo a través de o3 (mismo proveedor, mismo nivel de razonamiento, mismo comportamiento de "pensar antes de responder") y la brecha se reduce a 3,6 veces. Esa no es una diferencia de redondeo. Significa que la pregunta "¿cuánto cuesta un modelo de razonamiento en comparación con uno abierto" no tiene una respuesta única? Tiene una respuesta diferente para cada modelo que envía OpenAI, porque la propia línea de razonamiento de OpenAI abarca un rango de 7,5 veces incluso antes de que hayas mirado fuera de su catálogo.

La alineación, lado a lado

Extraído directamente de nuestra tabla de precios (387 modelos rastreados, actualizados por última vez con los documentos del proveedor): los cuatro SKU de razonamiento actuales de OpenAI, más el R1 de DeepSeek y sus variantes destiladas, por 1 millón de tokens.

ModeloProveedorEntrada /1MSalida /1Mfrente a DeepSeek R1 (combinado)
o1AbiertoAI$15.00$60.0027.4×
o3AbiertoAI$2.00$8.003.7×
o4-mini / o3-mini / o1-miniAbiertoAI$1.10$4.402.0×
Grok 4 RazonamientoxAI$3.00$15.006.2×
Búsqueda profunda R1búsqueda profunda$0.55$2.191.0×
DeepSeek R1 Destilado Llama 70Bbúsqueda profunda$0.23$0.690.35×
DeepSeek R1 Destilar Qwen 32Bbúsqueda profunda$0.18$0.180.11×
Precios de referencia de nuestra mesa con orugas, 387 modelos. "vs DeepSeek R1" utiliza una proporción de token de entrada:salida combinada de 3:8 que coincide con el ejemplo trabajado a continuación. Ejecute su propia proporción en el calculadora de costos de tokens de razonamiento.

Observe la forma de esa curva. No es una línea recta de lo caro a lo barato: o1 a o3 por sí solo es un recorte del 87% en el precio de producción dentro del propio catálogo de OpenAI, sin ningún competidor involucrado. Las variantes destiladas de DeepSeek luego rebajaron incluso el R1 completo en otras 3-5 veces, a un costo de capacidad real sobre el cual los puntos de referencia son honestos. Cuatro puntos en una tabla, cuatro historias completamente diferentes sobre lo que significa "el impuesto al razonamiento".

Un ejemplo práctico: 10.000 solicitudes al mes

Un agente de clasificación de soporte que razona antes de responder: 1500 tokens de contexto de entrada por ticket, 4000 tokens de salida una vez que se cuentan los tokens de cadena de pensamiento ocultos facturados como salida. 10,000 tickets por mes son 15 millones de tokens de entrada y 40 millones de tokens de salida, ejecutados en cada modelo:

ModeloCosto de insumosCosto de producciónTotal mensual
o1$225.00$2,400.00$2,625.00
Grok 4 Razonamiento$45.00$600.00$645.00
o3$30.00$320.00$350.00
o4-mini$16.50$176.00$192.50
Búsqueda profunda R1$8.25$87.60$95.85
10 000 boletos/mes × 1500 tokens de entrada/4000 de salida. Carga de trabajo ilustrativa: valore su propia combinación en el calculadora de costos de tokens de razonamiento.

$ 2625 al mes en o1 versus $ 95,85 en DeepSeek R1 para una carga de trabajo que, en papel, exige lo mismo de ambos modelos. Cambie o1 por o3 y la factura de OpenAI por sí sola caerá un 87%, de $ 2,625 a $ 350, antes de que DeepSeek entre en la comparación. La mayoría de las historias de terror sobre el "impuesto de razonamiento" que circulan ahora son en realidad sobre precios heredados de cuando era la única opción de razonamiento de frontera. Ya no lo es, ni siquiera dentro de la propia línea de OpenAI.

Por qué la brecha no es la misma en todas partes

o1 tenía un precio cuando la inferencia de razonamiento era escasa y en su mayoría no estaba probada: se encontraba cerca de la parte superior de todo el catálogo de OpenAI, con razonamiento o no. o3 y o4-mini surgieron después de que la competencia (DeepSeek R1 se lanzó en enero, seguido de los niveles de razonamiento de Grok y Gemini) obligó a los laboratorios fronterizos a defender los precios de razonamiento de la misma manera que ya se habían visto obligados a defender los precios de chat emblemáticos. Los modelos de razonamiento de mini niveles en particular ahora se acercan lo suficiente a los precios de nivel medio no racionales que "¿debo usar un modelo de razonamiento" ha dejado de ser principalmente una cuestión de costos para muchas cargas de trabajo; en cambio, es una cuestión de latencia y cadena de pensamiento-presupuesto de tokens?

Lo que no ha convergido es la calidad por dólar en lo más alto. o1 y o3 no son intercambiables: o3 es el modelo más nuevo y generalmente más potente a una fracción del precio, lo cual es una actualización sencilla. DeepSeek R1 es una compensación diferente: pesos abiertos, autohospedable y con un precio similar, pero comparado significativamente con o3 en tareas de razonamiento difíciles en la mayoría de las evaluaciones de terceros que hemos visto citadas. El número 27x contra o1 es real y vale la pena conocerlo. No es la misma afirmación que "R1 reemplaza a o3 por 27 veces menos": esa comparación está más cerca de 3,7 veces y es una compensación de capacidad, no una actualización gratuita.

La regla de decisión

No se fije en el precio de o1: es el SKU de razonamiento más caro del mercado por un amplio margen y cada vez más no es el que los equipos deberían comparar. Ancle o3 u o4-mini como línea base realista de OpenAI, luego decida si el descuento restante de 2 a 4 veces de DeepSeek R1 vale la pena por el autohospedaje o la inferencia de terceros, y si la caída de capacidad de las variantes destiladas es aceptable para su tarea. Ponga precio a su combinación de tokens real: las cargas de trabajo de razonamiento sesgan la producción pesada de una manera que las cargas de trabajo de chat no lo hacen, por lo que la proporción combinada importa más aquí que en casi cualquier otro lugar en la pila de costos de API. Ejecute los números en el calculadora de costos de tokens de razonamiento o el calculadora de razonamiento de desbordamiento de tokens si los tokens ocultos de la cadena de pensamiento son la parte que no puedes predecir, y ve el impuesto al token de razonamiento para ver cómo se compara o3 con GPT-4.1 sin razonamiento en el mismo mensaje.

Metodología: precios de nuestra tabla de precios rastreada (387 modelos) a partir de agosto de 2026, que coinciden con las tarifas publicadas por cada millón de tokens. El ejemplo trabajado utiliza una proporción de tokens construida de 1500 entradas/4000 salidas para ilustrar el escalamiento, no la telemetría de un sistema de producción: confirme la combinación de tokens de su propia carga de trabajo y la tasa actual de cada proveedor antes de realizar el presupuesto.