Kostenrechner für KI-Neuronen von Cloudflare Workers
✓ Zuletzt überprüft: 01.09.2026· Die angezeigten Neuron-Preise sind die von Cloudflare veröffentlichten Preise pro Modell und keine Live-Kurse· Referenzschätzung — Änderung melden → Cloudflare Workers AI rechnet jedes Modell – Textgenerierung, Bildgenerierung, Einbettungen, was auch immer Sie ausführen – in einer normalisierten Einheit namens a ab Neuron, Preis bei 0,011 $ pro 1.000 Neuronen. Jedes Konto erhält 10.000 Neuronen/Tag kostenlos, wird für Ihr gesamtes Konto freigegeben, unabhängig davon, welche Models Sie anrufen, und wird täglich um 00:00 UTC zurückgesetzt. Das ist eine völlig andere Abrechnungsform als die 1-Millionen-Dollar-Token-Rate eines einzelnen Modells: Eine Llama-3.2-1B-Chat-Funktion, ein Flux-1-schnell-Bildgenerator und eine BGE-Einbettungspipeline basieren alle auf dem Dasselbe Das heißt, dass die Zusammensetzung der Arbeitsbelastung – und nicht nur das Volumen – darüber entscheidet, wann Sie mit der Zahlung beginnen. Dieser Rechner kombiniert Text-, Bild- und Einbettungsnutzung in einer Neuron-Gesamtsumme, wendet das gemeinsame kostenlose Kontingent an und berechnet die Überschreitung. Informationen zu den Rohpreisen für Hyperscaler-Token finden Sie unter Kostenrechner für Kontextfenster; Informationen zu Edge- und Cloud-Kompromissen finden Sie im Edge-/On-Device-KI vs. Cloud-Rechner.
—Pro Tag verbrauchte Neuronen
—Neuronen werden pro Tag abgerechnet (über 10.000 kostenlos)
—in Rechnung gestellte Kosten pro Tag
Größter Treiber Ihrer Neuron-Rechnung
—
Neuronenaufschlüsselung nach Arbeitslasttyp
Wie Ihr tägliches kostenloses Kontingent von 10.000 Neuronen in den oben genannten Einstellungen auf die drei Workload-Typen aufgeteilt wird.
| Arbeitsbelastung | Neuronen/Tag | % der Gesamtmenge |
|---|
Monatliche Kosten pro Textanfrage/Tag
Die Bild- und Einbettungsnutzung wird bei den oben genannten Werten gehalten und über alle Textanfragen pro Tag verteilt. Dies zeigt, wo das gemeinsame kostenlose Kontingent von 10.000 pro Tag aufgebraucht ist. Die hervorgehobene Zeile kommt Ihrer aktuellen Eingabe am nächsten.
| Textanforderung/Tag | Gesamtzahl der Neuronen pro Tag | Überzählige Neuronen/Tag | Monatliche Kosten |
|---|
Wie dies mit anderen Tools verbunden ist
Dieser Rechner berechnet die Preise für eine bestimmte Mechanik: die Neuron-Einheit von Cloudflare Workers AI, die die Textgenerierung, Bildgenerierung und Einbettungen in einer Zahl normalisiert und sie mit einem einzigen gemeinsamen täglichen Gratiskontingent abrechnet. Das ist anders als die Kostenrechner für Cloudflare Workers, bei dem die serverlose Rechenleistung von Workers (CPU-Zeit und Anfragen) und nicht die Modellinferenz von Workers AI bewertet wird. Es ist auch eine andere Frage als die reine GPU-Vermietung – siehe GPU-Inferenzkostenrechner für selbstgehostete Inferenzökonomie und die Edge-/On-Device-KI vs. Cloud-Rechner Denn wenn Inferenz am Edge ausgeführt wird, ist sie einer zentralisierten Cloud-API überhaupt überlegen. Das Bild und die eingebetteten Hälften dieses Rechners mit Einzelpreisen ohne den gemeinsam genutzten Neuron-Pool finden Sie unter Kostenrechner für die Bilderzeugung und die Kostenrechner für Einbettungen.
So funktioniert dieser Rechner
Der Kostenrechner für KI-Neuronen von Cloudflare Workers wandelt drei verschiedene Workload-Typen in eine gemeinsame Einheit um. Text: Bei den Standardwerten (Llama 3.1 70B, 300 Anfragen/Tag, 800 Input + 300 Output-Tokens/Anfrage) kostet jede Anfrage 800/1.000.000 × 26.668 + 300/1.000.000 × 204.805 = 21,33 + 61,44 = 82,78 Neuronen, also brennen ungefähr 300 Anfragen/Tag 24.833 Neuronen/Tag. Bild: Flux-1-schnell bei 1 Plättchen (512×512) und 4 Schritten kostet 1 × 4,80 + 4 × 9,60 = 43,20 Neuronen/Bild, also 20 Bilder/Tag addiert 864 Neuronen/Tag. Einbettungen: BGE-small bei 100.000 Input-Tokens/Tag kostet 100.000/1.000.000 × 1.841 = 184,1 Neuronen/Tag. Die Gesamtnutzung beträgt ungefähr 25.881 Neuronen/Tag.
Gegen die 10.000 Neuronen/Tag kostenloses Kontingent (auf alle drei Workload-Typen verteilt, täglich um 00:00 UTC zurückgesetzt), so dass ca 15.881 überalterte Neuronen/Tag, abgerechnet mit 0,011 $ pro 1.000 Neuronen: 15,881 × 0,011 $ ≈ 0,175 $/Tag, oder ungefähr 5,24 $/Monat bei 30 aktiven Tagen. Bei diesen Einstellungen ist die Textgenerierung der dominierende Treiber – etwa 96 % der täglichen Neuronen – daher ist die Modellauswahl für Text (70B vs. 1B) für die Rechnung weitaus wichtiger als das Bild oder das Einbettungsvolumen. Da es sich beim kostenlosen Kontingent um einen gemeinsamen, kontoweiten Pool und nicht um ein Kontingent pro Modell handelt, gelangen Sie durch das Hinzufügen von Bildern oder das Einbetten von Aufrufen in eine bereits textlastige App schneller zu kostenpflichtigen Neurons, als dies bei beiden Workloads allein der Fall wäre.
Häufig gestellte Fragen
Was ist ein Cloudflare Workers AI Neuron und wie wird es berechnet?
Ein Neuron ist die normalisierte Einheit von Cloudflare zur Messung der GPU-Rechenleistung, die eine KI-Anfrage auf Workers AI verbraucht. Die Abrechnung erfolgt mit 0,011 US-Dollar pro 1.000 Neuronen. Jedes Modell hat seine eigene Neuronenrate pro Arbeitseinheit: Llama-3.2-1B kostet 2.457 Neuronen pro Million Eingabe-Tokens und 18.252 pro Million Ausgabe-Tokens; der größere Llama-3.1-70B kostet 26.668 pro Million Input-Tokens und 204.805 pro Million Output-Tokens; Die Flux-1-Schnell-Bilderzeugung kostet 4,80 Neuronen pro 512×512-Kachel plus 9,60 Neuronen pro Schritt; BGE-Small-Einbettungen kosten 1.841 Neuronen pro Million Eingabetokens und BGE-Large-Einbettungen kosten 18.582. Da jeder Modelltyp in dieselbe Neuron-Einheit konvertiert wird, können ein textlastiger Arbeitsaufwand und ein bildlastiger Arbeitsaufwand in einer Zeile verglichen und abgerechnet werden.
Wie viel Cloudflare Workers AI ist kostenlos?
Jedes Konto erhält 10.000 Neuronen pro Tag kostenlos, sowohl im Workers Free- als auch im Workers Paid-Plan, die täglich um 00:00 UTC zurückgesetzt werden. Bei diesem Kontingent handelt es sich um einen einzigen gemeinsamen Pool für Ihr gesamtes Konto – es spielt keine Rolle, ob die Neuronen aus der Textgenerierung, Bildgenerierung oder Einbettungen stammen, sie beziehen sich alle auf die gleichen täglichen 10.000. Sobald Sie diese an einem bestimmten Tag überschreiten, wird die Überschreitung mit 0,011 USD pro 1.000 Neuronen berechnet, was die Teilnahme am Workers Paid-Plan erfordert.
Warum ist das Mischen von Modelltypen in einer App für den Neuron-Gesetzentwurf wichtig?
Denn das kostenlose Kontingent von 10.000 Neuronen/Tag wird auf jedes von Ihnen aufgerufene Modell aufgeteilt und nicht pro Modell zugewiesen. Eine App, die ein kleines Textmodell aufruft, ein paar Bilder generiert und Dokumente einbettet, greift alle auf denselben täglichen Pool zurück, sodass die Reihenfolge und Mischung der Aufrufe bestimmt, wie schnell Sie das kostenlose Kontingent durchbrennen. Auch die Wahl des Modells ist enorm wichtig: Llama-3.1-70B verbraucht ungefähr 11x mehr Neuronen pro Eingabe-Token und 11x mehr pro Ausgabe-Token als Llama-3.2-1B, sodass der Wechsel zum größeren Modell an einem arbeitsreichen Tag eine 0-Dollar-Rechnung selbst bei identischem Verkehrsaufkommen in eine bezahlte Rechnung verwandeln kann.
Wie sind die Preise für Workers AI Neuron im Vergleich zu den Roh-Token-Preisen auf OpenAI oder Anthropic?
Hyperscaler-LLM-APIs wie OpenAI und Anthropic rechnen direkt in Dollar pro Million Token ab, mit einer unterschiedlichen Eingabe- und Ausgaberate für jedes Modell und keinem einheitlichen täglichen kostenlosen Kontingent, das für alle Modelltypen geteilt wird – sehen Sie sich unseren Kontextfenster-Kostenrechner und den 387-Modell-Preisvergleich für diese Form an. Workers AI wandelt stattdessen die Rechenkosten jedes Modells in eine abstrakte Einheit (das Neuron) um, die mit einem Pauschalpreis von 0,011 US-Dollar pro 1.000 Neuronen abgerechnet wird, mit einem kontenweiten kostenlosen Kontingent von 10.000 Neuron/Tag, das unabhängig davon gilt, welche Modelle Sie kombinieren. Der Nachteil besteht darin, dass Sie kleinere, von Cloudflare gehostete offene Modelle (Llama, Flux, BGE) am Edge statt geschlossener Frontier-Modelle ausführen, im Gegenzug für einen vorhersehbaren Preis pro Einheit und kostenlosen täglichen Spielraum.