So funktioniert dieser Rechner
Kostenloser Batch-Verarbeitungsrechner – Artikelanzahl, jeweils Token, Geschwindigkeit und Parallelität zur Gesamtzeit und Gesamtkosten eines LLM-Massenauftrags.
Häufig gestellte Fragen
Wie kann ich abschätzen, wie lange ein LLM-Massenauftrag dauert?
Gesamtzahl der Token = Artikel × Token pro Artikel. Teilen Sie durch den kombinierten Durchsatz (Geschwindigkeit pro Arbeiter × Anzahl paralleler Arbeiter), um Sekunden in Sekundenschnelle zu erhalten. Zehn Arbeiter mit 60 Token/s liefern 600 Token/s, sodass ein 8-M-Token-Auftrag etwa 3,7 Stunden dauert – bevor Sie durch Ratenbeschränkungen gedrosselt werden.
Sollte ich stattdessen die Batch-API verwenden?
Wenn der Job nicht zeitkritisch ist, ja. Batch-Endpunkte (OpenAI, Anthropic, Gemini) führen Jobs asynchron innerhalb eines 24-Stunden-Fensters zum etwa halben Preis pro Token aus. Sie tauschen sofortige Latenz gegen einen großen Rabatt – ideal für Einbettungen, Backfills, Auswertungen und Offline-Anreicherung.