Skip to content
AI

Por que meu agente continua consumindo recursos depois que qualquer orçamento razoável já teria interrompido sua execução?

85

Oportunidade

Agentes de IA executando fluxos de trabalho de múltiplas etapas consomem tokens a uma taxa de 20 a 100 vezes superior à de uma única consulta, e não existe nenhum primitivo no nível de infraestrutura para impor um teto de gastos ou de computação em tempo de execução. Quando dois agentes entram em um loop recursivo de esclarecimento ou um agente de recuperação busca contexto em excesso, o único sinal é a fatura no fim do mês. Frameworks como LangGraph e AutoGen lidam com retentativas e checkpoints, mas nenhum impõe um contrato de recursos que interrompa a execução quando um orçamento declarado é ultrapassado. Um artigo do arXiv de janeiro de 2026 formaliza como seria esse contrato, mas a distância entre essa formalização e um primitivo implantável que funcione entre provedores de modelos e chamadas de ferramentas permanece enorme.

Por que importa

Um contrato de recursos em tempo de execução é a camada de segurança ausente que torna os deployments de agentes seguros para entregar a não-engenheiros.

Como avalio a oportunidade

A Pontuação de Oportunidade é minha própria leitura, não uma medição: o quanto dói, com que frequência aparece e o quanto pouco existe para resolvê-lo hoje. Quanto maior, mais vale a pena construir, na minha opinião.

Gravidade9/10

O quanto de dor causa quando aparece.

Frequência8/10

Com que frequência as pessoas realmente se deparam com isso.

Lacuna8/10

O quanto pouco de boas ferramentas existe para isso hoje.

Mais problemas que merecem ser resolvidos