✓ Última verificación: 2026-08-15· Fuente: página oficial de precios del proveedor.· Supervisado automáticamente — reportar cambio →
Pegue los recuentos de tokens de entrada y salida y vea exactamente cuánto cuesta una llamada en cada modelo principal, clasificado en primer lugar como el más barato. La forma más rápida de comparar precios de GPT, Claude, Gemini y DeepSeek.
Los proveedores valoran los tokens de entrada y salida por separado – y la producción suele costar entre 3 y 5 veces más que los insumos. Por lo tanto, una sugerencia breve con una respuesta larga puede costar más que una sugerencia larga con una respuesta corta. Ingrese sus dos números y vea el costo real por llamada en todos los modelos.
—
más barato / llamar
—modelo más barato
—total de llamadas
—fichas / llamada
Costo por llamada por modelo
Su token cuenta, cada modelo, clasificado como el más barato en primer lugar. Los precios son por 1 millón de tokens.
Modelo
En $/1 millón
Salida $/1 millón
Costo/llamada
⚠️ Estimación utilizando precios de referencia (julio 2026) y tarifas de lista. Los precios reales cambian y varían según el nivel, la región, la duración del contexto y los descuentos por almacenamiento en caché/por lotes. Para contexto repetido, consulte almacenamiento en caché de avisos; para trabajos asincrónicos masivos, consulte precios por lotes. · Informar precio desactualizado →
Cómo funciona el costo del token
La fórmula es sencilla: costo = (tokens de entrada ÷ 1.000.000 × precio de entrada) + (tokens de salida ÷ 1.000.000 × precio de salida). Los dos precios son diferentes a propósito: generar texto (salida) es más caro que leerlo (entrada), normalmente entre 3 y 5 veces. Por eso, el factor más importante en su factura suele ser longitud de salida de limitación, sin recortar el mensaje. Como guía aproximada, 1000 tokens ≈ 750 palabras en inglés, pero el código y otros lenguajes tokenizan de manera diferente, así que mida con el tokenizador del proveedor para obtener cifras exactas.
El Calculadora de costos de tokens LLM estima lo que cuesta una llamada API de modelo de idioma único en función del número de fichas de entrada que envías y el fichas de salida el modelo regresa. Debido a que los proveedores fijan el precio de los tokens de entrada y salida a diferentes tasas por millón, ambos recuentos determinan el total, y los tokens de salida suelen ser los más caros de los dos. También puedes introducir un recuento de llamadas para proyectar el costo en muchas solicitudes idénticas. La herramienta aplica las tarifas publicadas de cada modelo y luego clasifica los resultados. más barato primero entre proveedores como GPT, Claude, Gemini y DeepSeek, para que pueda comparar la misma carga de trabajo en paralelo.
La contrapartida clave a tener en cuenta es que el precio más bajo por token no siempre es el costo real más bajo. Un modelo que produce respuestas más largas y detalladas puede quemar más tokens de salida y terminar siendo más caro que uno nominalmente más caro. Calcule con recuentos de tokens que reflejen su actual indicaciones y duración típica de la respuesta, ya que una prueba corta rara vez predice el volumen de producción. Vuelva a verificar la clasificación cada vez que cambie el tamaño de la solicitud, el resultado esperado o la frecuencia de las llamadas, porque la opción más barata puede cambiar a medida que se mueve cualquiera de esas entradas.
Preguntas frecuentes
¿Cómo se calcula el costo del token LLM?
Costo = (tokens de entrada / 1.000.000 × precio de entrada) + (tokens de salida / 1.000.000 × precio de salida). Los proveedores fijan el precio de los insumos y los resultados por separado, y los resultados suelen ser entre 3 y 5 veces más caros que los insumos, por lo que las respuestas largas cuestan más que las indicaciones largas.
¿Cuántas fichas tiene una palabra?
Para el inglés, aproximadamente 1 ficha equivale aproximadamente a 0,75 palabras, por lo que 1000 fichas equivalen a unas 750 palabras. El código, los números y otros lenguajes se tokenizan de manera diferente, por lo que siempre mida con el tokenizador del proveedor para obtener recuentos exactos.