Volumen de sesión
Costo del token por sesión
Llamadas a herramientas (por ejemplo, búsqueda web)
—
tiempo de ejecución / mes—fichas / mes
—llamadas de herramientas / mes
—total/mes
Costo por escala
El costo del tiempo de ejecución aumenta con la duración de la sesión del reloj de pared, independientemente de cuánto hizo el modelo; El costo del token aumenta con la cantidad que realmente se lee y escribe. Ambos crecen linealmente con el número de sesiones, pero un agente lento paga desproporcionadamente más tiempo de ejecución por sesión.
| Sesiones/mes | Tiempo de ejecución | Fichas | Herramientas | Total |
|---|
Por qué la facturación por horas de sesión es una partida separada
Las plataformas de agentes alojadas facturan cada vez más el entorno de ejecución en sí (el entorno de pruebas, el contexto del navegador o el contenedor de ejecución en el que se ejecuta el agente) además de las tarifas de token del modelo estándar. Una tarifa representativa para 2026 es de aproximadamente 0,08 dólares por hora de funcionamiento activo. Esto no reemplaza el precio de los tokens, es aditivo: una sesión larga de agente paga tanto por el tiempo que su entorno permanece aprovisionado como por cada token que el modelo subyacente lee o escribe mientras ese entorno está activo. Dos agentes que realizan la misma tarea pueden acumular facturas muy diferentes si uno termina en 90 segundos y el otro tarda 8 minutos, incluso con recuentos de tokens casi idénticos, porque el más lento ocupa el tiempo de ejecución facturado durante más tiempo.
Esta es exactamente la brecha entre esta calculadora y una herramienta de costo de agente pura por paso o por token: esos precios los llama el modelo, esto agrega la dimensión que escala con el tiempo de la sesión en lugar del trabajo realizado. Es más importante para los agentes que esperan llamadas lentas a herramientas, exploran páginas o ejecutan ciclos prolongados de uso de herramientas: el tiempo que el modelo pasa inactivo dentro de una sesión activa todavía quema la facturación de horas de sesión, aunque quema muy pocos tokens durante esa espera.
Además de ambos, está el uso medido de la herramienta: una tarifa común en 2026 para una herramienta de búsqueda web integrada es de aproximadamente $10 por cada 1,000 búsquedas. Un agente que busca generosamente puede acumular costos significativos de herramientas independientemente tanto de su tiempo de ejecución como de su factura de tokens. El costo total del agente en 2026 es en realidad de tres medidores apilados: horas de ejecución, tokens y llamadas de herramientas; tratar cualquiera de ellos como "el" costo subestima la factura real. Para ver la vista pura por paso/token sin facturación de tiempo de ejecución, consulte la Calculadora de costos de agentes de IA o el calculadora de presupuesto de bucle de agente para la planificación de costos descontrolados P99.
Calculadora de costos del agente de IAPresupuesto del bucle del agenteCosto del paso del agente de IACosto del agente de uso de computadoraCosto de la herramienta de búsqueda web
Cómo funciona esta calculadora
Calculadora gratuita de costos de sesión de agente administrado: modela la dimensión de facturación de horas de sesión de 2026 (por ejemplo, $0,08/hora de ejecución activa) además de las tasas estándar de tokens de entrada/salida y los costos de herramientas como la búsqueda web, para que pueda ver el costo real de la ejecución de un agente alojado, no solo sus tokens.
Preguntas frecuentes
¿Qué es la facturación por horas de sesión para los agentes de IA?
Algunos tiempos de ejecución de agentes administrados/alojados ahora facturan un cargo por hora por el entorno de ejecución activo en sí (el entorno de pruebas, el navegador o el contexto de ejecución en el que opera el agente) por separado del costo simbólico de las llamadas al modelo que realiza. Una tarifa representativa para 2026 es de aproximadamente 0,08 dólares por hora de sesión de tiempo de ejecución activo. Esto se suma al precio estándar de los tokens de entrada/salida, no lo reemplaza: una sesión de agente de larga duración paga tanto por el tiempo que su entorno permanece activo como por cada token que el modelo lee o escribe durante ese tiempo.
¿En qué se diferencia de una calculadora de costos de agente por paso o por token?
Las calculadoras de agentes basadas en pasos y tokens fijan el precio de las llamadas del modelo: cuántos turnos, cuántos tokens de entrada/salida por turno. Esta calculadora agrega la dimensión que se pierden: la propia carga por hora del entorno de ejecución, que escala con la duración de la sesión del reloj de pared, no con cuánto hizo realmente el modelo durante ese tiempo. Un agente lento que tarda 20 minutos en finalizar una tarea paga por 20 minutos de facturación por hora de sesión incluso si realizó muy pocas llamadas de modelo en esa ventana; un agente rápido que termina en 2 minutos la misma tarea paga mucho menos costo de tiempo de ejecución, independientemente del recuento de tokens. Ambas dimensiones importan y esta herramienta las modela juntas.
¿Qué otros costos por uso suelen agregar los agentes administrados?
Más allá de las horas de ejecución y el costo del token, las plataformas de agentes alojadas comúnmente miden las llamadas a herramientas individuales por separado: una tarifa común en 2026 para una herramienta de búsqueda web integrada es de aproximadamente $10 por cada 1,000 búsquedas. Si la tarea de su agente implica explorar, buscar o llamar a otras herramientas medidas, esos costos por llamada se acumulan además del tiempo de ejecución y el costo del token de la misma manera que una factura en la nube acumula el cálculo, el almacenamiento y la salida como partidas separadas.