Como funciona esta calculadora
Calculadora gratuita de processamento em lote - contagem de itens, tokens cada, velocidade e simultaneidade com o tempo de parede e custo total de um trabalho LLM em massa.
Perguntas frequentes
Como posso estimar quanto tempo leva um trabalho LLM em massa?
Total de tokens = itens × tokens por item. Divida pela taxa de transferência combinada (velocidade por trabalhador × número de trabalhadores paralelos) para obter os segundos do relógio de parede. Dez trabalhadores a 60 tok/s entregam 600 tok/s, portanto, um trabalho de 8 milhões de tokens leva cerca de 3,7 horas – antes que os limites de taxa o limitem.
Devo usar a API em lote?
Se o trabalho não for urgente, sim. Os endpoints em lote (OpenAI, Anthropic, Gemini) executam trabalhos de forma assíncrona em uma janela de 24 horas por aproximadamente metade do preço por token. Você troca a latência imediata por um grande desconto – ideal para preenchimentos de incorporações, avaliações e enriquecimento offline.