Por que meu agente continua consumindo recursos depois que qualquer orçamento razoável já teria interrompido sua execução?
Oportunidade
Agentes de IA executando fluxos de trabalho de múltiplas etapas consomem tokens a uma taxa de 20 a 100 vezes superior à de uma única consulta, e não existe nenhum primitivo no nível de infraestrutura para impor um teto de gastos ou de computação em tempo de execução. Quando dois agentes entram em um loop recursivo de esclarecimento ou um agente de recuperação busca contexto em excesso, o único sinal é a fatura no fim do mês. Frameworks como LangGraph e AutoGen lidam com retentativas e checkpoints, mas nenhum impõe um contrato de recursos que interrompa a execução quando um orçamento declarado é ultrapassado. Um artigo do arXiv de janeiro de 2026 formaliza como seria esse contrato, mas a distância entre essa formalização e um primitivo implantável que funcione entre provedores de modelos e chamadas de ferramentas permanece enorme.
Por que importa
Um contrato de recursos em tempo de execução é a camada de segurança ausente que torna os deployments de agentes seguros para entregar a não-engenheiros.
Como avalio a oportunidade
A Pontuação de Oportunidade é minha própria leitura, não uma medição: o quanto dói, com que frequência aparece e o quanto pouco existe para resolvê-lo hoje. Quanto maior, mais vale a pena construir, na minha opinião.
O quanto de dor causa quando aparece.
Com que frequência as pessoas realmente se deparam com isso.
O quanto pouco de boas ferramentas existe para isso hoje.
Mais problemas que merecem ser resolvidos
Por que todo aplicativo de IA me esquece no momento em que fecho a aba?
AIPor que aprender uma nova área ainda depende de saber o que perguntar?
AIPor que uma pessoa sem especialização não consegue verificar o que uma IA acabou de dizer?
AIPor que testamos modelos em benchmarks mas os lançamos em produção no achismo?
AIPor que agentes de IA não têm memória dos próprios erros?
AIPor que não consigo auditar em que um modelo foi realmente treinado?