Calculadora de costos de neuronas de IA para trabajadores de Cloudflare
✓ Última verificación: 2026-09-01· Las tarifas de neuronas que se muestran son tarifas por modelo publicadas por Cloudflare, no cotizaciones reales· Estimación de referencia — reportar cambio → Cloudflare Workers AI factura cada modelo (generación de texto, generación de imágenes, incrustaciones, lo que sea que ejecute) en una unidad normalizada llamada Neurona, con un precio de 0,011 dólares por 1.000 neuronas. Cada cuenta obtiene 10.000 Neuronas/día gratis, compartido en toda su cuenta independientemente de los modelos a los que llame, y se reinicia diariamente a las 00:00 UTC. Esa es una forma de facturación realmente diferente de la tarifa de token de $/millón de un solo modelo: una función de chat Llama-3.2-1B, un generador de imágenes Flux-1-schnell y un canal de incrustaciones BGE, todos se basan en el mismo asignación diaria, por lo que la combinación de cargas de trabajo, no solo el volumen, determina cuándo comienza a pagar. Esta calculadora combina el uso de texto, imágenes e incrustaciones en un total de Neuron, aplica el nivel gratuito compartido y fija el precio del excedente. Para conocer el precio bruto de los tokens de hiperescalador, consulte el calculadora de costos de ventana contextual; para ver las compensaciones entre el borde y la nube, consulte el Calculadora de IA en el dispositivo o en el borde frente a la nube.
—Neuronas utilizadas por día
—Neuronas facturadas por día (más de 10.000 gratis)
—costo facturado por día
El mayor impulsor de tu factura de Neuron
—
Desglose de neuronas por tipo de carga de trabajo
Cómo se divide su asignación diaria gratuita de 10 000 neuronas entre los tres tipos de carga de trabajo en la configuración anterior.
| Carga de trabajo | Neuronas/día | % del total |
|---|
Costo mensual por solicitudes de texto/día
El uso de imágenes e incrustaciones se mantuvo en los valores anteriores, se extendió a través de las solicitudes de texto por día y muestra dónde se agota la asignación gratuita compartida de 10 000 por día. La fila resaltada es la más cercana a su entrada actual.
| Solicitud de texto/día | Neuronas totales/día | Neuronas excedentes/día | Costo mensual |
|---|
Cómo funciona esta calculadora
El Calculadora de costos de neuronas de IA para trabajadores de Cloudflare convierte tres tipos de cargas de trabajo diferentes en una unidad compartida. Texto: en los valores predeterminados (Llama 3.1 70B, 300 solicitudes/día, 800 entradas + 300 tokens de salida/solicitud), cada solicitud cuesta 800/1.000.000 × 26.668 + 300/1.000.000 × 204.805 = 21,33 + 61,44 = 82,78 neuronas, por lo que 300 solicitudes/día se queman aproximadamente 24.833 Neuronas/día. Imagen: Flux-1-schnell en 1 mosaico (512×512) y 4 pasos cuesta 1 × 4,80 + 4 × 9,60 = 43.20 Neuronas/imagen, por lo que se agregan 20 imágenes/día 864 Neuronas/día. Incrustaciones: BGE-pequeño con 100.000 tokens de entrada/día cuesta 100.000/1.000.000 × 1.841 = 184,1 Neuronas/día. El uso total es aproximadamente 25.881 Neuronas/día.
Contra el 10.000 neuronas/día asignación gratuita (compartida entre los tres tipos de carga de trabajo, reiniciada diariamente a las 00:00 UTC), que deja aproximadamente 15.881 neuronas excedentes/día, facturado a 0,011 dólares por 1.000 neuronas: 15,881 × 0,011 dólares ≈ $0.175/día, o aproximadamente $5.24/mes a los 30 días activos. La generación de texto es el factor dominante en estos entornos (alrededor del 96 % de las neuronas diarias), por lo que la elección del modelo para el texto (70 mil millones frente a 1 mil millones) es mucho más importante para la factura que la imagen o el volumen de incrustación. Debido a que el nivel gratuito es un grupo compartido para toda la cuenta en lugar de una asignación por modelo, agregar imágenes o incrustar llamadas a una aplicación que ya contiene mucho texto lo lleva a Neurons pagado más rápido de lo que lo haría cualquier carga de trabajo por sí sola.
Preguntas frecuentes
¿Qué es una neurona de IA de trabajadores de Cloudflare y cómo se calcula?
Una neurona es la unidad normalizada de Cloudflare para medir el cómputo de GPU que consume una solicitud de IA en Workers AI, facturada a $0,011 por cada 1000 neuronas. Cada modelo tiene su propia tasa de neuronas por unidad de trabajo: Llama-3.2-1B cuesta 2.457 neuronas por millón de tokens de entrada y 18.252 por millón de tokens de salida; el Llama-3.1-70B más grande cuesta 26.668 por millón de tokens de entrada y 204.805 por millón de tokens de salida; La generación de imágenes Flux-1-schnell cuesta 4,80 neuronas por mosaico de 512 × 512 más 9,60 neuronas por paso; Las incrustaciones pequeñas de BGE cuestan 1.841 neuronas por millón de tokens de entrada y las de BGE grandes cuestan 18.582. Debido a que cada tipo de modelo se convierte en la misma unidad Neuron, una carga de trabajo con mucho texto y una carga de trabajo con muchas imágenes se pueden comparar y facturar en una sola línea.
¿Qué parte de la IA de Cloudflare Workers es gratuita?
Cada cuenta obtiene 10 000 neuronas por día gratis, tanto en el plan Workers Free como en el Workers Paid, y se reinicia diariamente a las 00:00 UTC. Esa asignación es un único fondo compartido en toda su cuenta; no importa si las neuronas provienen de la generación de texto, de la generación de imágenes o de incrustaciones, todas se obtienen de las mismas 10 000 diarias. Una vez que lo excede en un día determinado, el excedente se factura a $0,011 por cada 1000 neuronas, lo que requiere estar en el plan Workers Paid.
¿Por qué es importante mezclar tipos de modelos en una aplicación para el proyecto de ley de Neuron?
Porque la asignación gratuita de 10 000 neuronas por día se comparte entre todos los modelos al que llama, no se asigna por modelo. Una aplicación que llama a un modelo de texto pequeño, genera algunas imágenes e incrusta documentos consume el mismo grupo diario, por lo que el orden y la combinación de llamadas determinan qué tan rápido se consume el nivel gratuito. La elección del modelo también es muy importante: Llama-3.1-70B quema aproximadamente 11 veces más neuronas por token de entrada y 11 veces más por token de salida que Llama-3.2-1B, por lo que cambiar al modelo más grande en un día ajetreado puede convertir un billete de $0 en uno pagado incluso con un volumen de tráfico idéntico.
¿Cómo se comparan los precios de Workers AI Neuron con los precios de los tokens sin procesar en OpenAI o Anthropic?
Las API de Hyperscaler LLM como OpenAI y Anthropic facturan directamente en dólares por millón de tokens, con una tasa de entrada y salida diferente para cada modelo y sin una asignación gratuita diaria unificada compartida entre los tipos de modelos; consulte nuestra calculadora de costos de ventana contextual y la comparación de precios de 387 modelos para esa forma. En cambio, Workers AI convierte el costo de cómputo de cada modelo en una unidad abstracta (la Neurona) facturada a una tarifa plana única de $0.011 por 1,000 Neuronas, con un nivel gratuito de 10,000 Neuronas/día para toda la cuenta que se aplica sin importar qué modelos mezcle. La desventaja es que está ejecutando modelos abiertos más pequeños alojados en Cloudflare (Llama, Flux, BGE) en el borde en lugar de modelos cerrados de frontera, a cambio de una tasa por unidad predecible y un margen diario gratuito.