más barato por correcto
prima / correcto
más barato / correcto
precisión de equilibrio

Precio de etiqueta frente al precio de un resultado

Cada modelo tiene un precio de dos maneras: el costo bruto por llamada y el costo efectivo una vez que se divide por la precisión para pagar los reintentos. La columna "reintentos" está por encima de la precisión: cuántos intentos se necesitan en promedio para obtener una buena respuesta. Se resalta la fila más barata por correcta; No siempre es la pegatina más barata.

Modelo$/llamadaExactitudIntentos/correcto$/correctoMensual

¿Cuánta precisión necesita el modelo más barato?

El costo efectivo del modelo más económico en una variedad de precisiones, frente al costo fijo por corrección del modelo premium. La fila donde se cruzan es la precisión del punto de equilibrio: por encima de ella gana el modelo más barato, por debajo sus reintentos lo convierten en la opción más cara.

Precisión más barataMás barato $/correctoPrima $/correctoGanador

El descuento que te cuesta dinero

Cada panel de selección de modelo clasifica por precio por millón de tokens, y cada uno de ellos responde la pregunta incorrecta. El costo que aparece en su factura no es el costo de una llamada, es el costo de una llamada que realmente puede utilizar, y en el momento en que su tarea tiene una respuesta correcta y una incorrecta, esos dos números se separan. Un modelo que es un 30% más barato por llamada pero diez puntos menos preciso no es un 30% más barato; una vez que vuelves a intentarlo o descartas sus errores, estás comprando más intentos por resultado utilizable, y la aritmética puede cambiar la clasificación por completo. La solución es una división: tomar el costo de un intento y dividirlo por la probabilidad de que el intento sea bueno, y comparar modelos al respecto. El punto de equilibrio que imprime esta calculadora es toda la decisión en un solo número: la precisión que un modelo más barato debe superar antes de que su descuento sea real, en lugar de un impuesto que se paga en reintentos. Esto supone que puedes distinguir el bien del mal y simplemente volver a ejecutar los fallos, que es exactamente la situación cuando tienes un conjunto de pruebas, un verificador o una revisión humana; si las malas respuestas se envían sin ser detectadas, el modelo barato es aún peor, porque ahora también se paga el costo de equivocarse en el futuro. Cotiza una sola llamada primero con el calculadora de costo simbólico, compare los precios de los modelos sin procesar en el página de comparación de modelosy si está encadenando llamadas a un agente, dimensione la grabación del token de tarea completa con el Calculadora de costos de agentes de IA.

Aloja tu proyecto:Océano Digital — $200 gratis ↗VPS Hostinger
Costo del tokenPrecio / RendimientoCosto de la prueba A/BCosto del agente de IAComparación de modelos