Preguntas frecuentes
¿Los modelos de razonamiento cobran por los tokens de pensamiento?
Sí. Modelos como o3 y Gemini Thinking generan tokens de razonamiento ocultos antes de la respuesta visible, y se facturan según la tarifa de salida. A menudo superan en número al resultado visible, por lo que el costo real es mucho mayor de lo que sugiere la longitud de la respuesta.
¿Cómo controlo el costo del razonamiento?
Utilice una configuración de esfuerzo de razonamiento cuando esté disponible, cambie a un modelo estándar para tareas simples y mida el uso real de los tokens de razonamiento; varía enormemente según el mensaje.