Perguntas frequentes
Por que os agentes de IA são tão caros?
Os agentes são executados em loop e cada etapa reenvia o histórico crescente – prompt do sistema, raciocínio anterior e todos os resultados da ferramenta até o momento. Esse contexto acumulado é cobrado novamente como entrada em cada etapa, portanto, uma tarefa de várias etapas custa várias vezes mais do que uma única chamada, mesmo antes de contar a saída extra.
Como posso controlar os custos do token do agente?
Resuma ou trunque o scratchpad em vez de carregar o histórico completo, limite o número de etapas, remova as saídas detalhadas da ferramenta antes de realimentá-las, armazene em cache o prompt estável do sistema e use um modelo mais barato para etapas de rotina. A alavanca é o contexto reenviado, que cresce a cada passo.