Comment fonctionne cette calculatrice
Calculateur de traitement par lots gratuit : nombre d'éléments, jetons chacun, vitesse et simultanéité par rapport à l'heure murale et coût total d'un travail LLM en masse.
Questions fréquemment posées
Comment puis-je estimer la durée d'un travail LLM en masse ?
Total de jetons = éléments × jetons par élément. Divisez par le débit combiné (vitesse par travailleur × nombre de travailleurs parallèles) pour obtenir les secondes d'horloge murale. Dix travailleurs à 60 tok/s fournissent 600 tok/s, donc un travail de 8 millions de jetons prend environ 3,7 heures – avant que les limites de débit ne vous limitent.
Dois-je plutôt utiliser l’API batch ?
Si le travail n’est pas urgent, oui. Les points de terminaison par lots (OpenAI, Anthropic, Gemini) exécutent des tâches de manière asynchrone dans une fenêtre de 24 heures pour environ la moitié du prix par jeton. Vous échangez une latence immédiate contre une remise importante – idéal pour les remplissages intégrés, les évaluations et l’enrichissement hors ligne.