Los proveedores valoran los tokens de entrada y salida por separado – y la producción suele costar entre 3 y 5 veces más que los insumos. Por lo tanto, una sugerencia breve con una respuesta larga puede costar más que una sugerencia larga con una respuesta corta. Ingrese sus dos números y vea el costo real por llamada en todos los modelos.
Costo por llamada por modelo
Su token cuenta, cada modelo, clasificado como el más barato en primer lugar. Los precios son por 1 millón de tokens.
| Modelo | En $/1 millón | Salida $/1 millón | Costo/llamada |
|---|
Cómo funciona el costo del token
La fórmula es sencilla: costo = (tokens de entrada ÷ 1.000.000 × precio de entrada) + (tokens de salida ÷ 1.000.000 × precio de salida). Los dos precios son diferentes a propósito: generar texto (salida) es más caro que leerlo (entrada), normalmente entre 3 y 5 veces. Por eso, el factor más importante en su factura suele ser longitud de salida de limitación, sin recortar el mensaje. Como guía aproximada, 1000 tokens ≈ 750 palabras en inglés, pero el código y otros lenguajes tokenizan de manera diferente, así que mida con el tokenizador del proveedor para obtener cifras exactas.
Próximos pasos
¿Estimar un producto completo, no una sola llamada? Utilice el Calculadora de costos de API de IA o el Estimador de costos de aplicaciones de IA. ¿Crear un agente o un chatbot? Prueba el Calculadora de costos de agentes de IA o calculadora de costos de chatbot. ¿Reutilizar el mismo contexto en cada llamada? Almacenamiento en caché rápido y trabajos por lotes cada corte cuesta más.