Cómo funciona esta calculadora
Calculadora de procesamiento por lotes gratuita: recuento de elementos, tokens de cada uno, velocidad y simultaneidad con el tiempo del reloj de pared y costo total de un trabajo de LLM en masa.
Preguntas frecuentes
¿Cómo calculo cuánto tiempo lleva un trabajo de LLM masivo?
Total de tokens = artículos × tokens por artículo. Divida por el rendimiento combinado (velocidad por trabajador × número de trabajadores paralelos) para obtener segundos de reloj de pared. Diez trabajadores a 60 tok/s entregan 600 tok/s, por lo que un trabajo de 8 millones de tokens tarda aproximadamente 3,7 horas, antes de que los límites de velocidad lo limiten.
¿Debería utilizar la API por lotes en su lugar?
Si el trabajo no es urgente, sí. Los puntos finales por lotes (OpenAI, Anthropic, Gemini) ejecutan trabajos de forma asincrónica dentro de un período de 24 horas a aproximadamente la mitad del precio por token. Cambia la latencia inmediata por un gran descuento, ideal para rellenos de incrustaciones, evaluaciones y enriquecimiento fuera de línea.