HeadlinesBriefing favicon HeadlinesBriefing.com

Codificação multi-agente precisa de uma camada de compromisso

Towards Data Science •
×

Sistemas de codificação multi-agente frequentemente falham não devido à comunicação ruim, mas porque os compromissos feitos em conversas não têm um registro persistente. Mesmo quando os agentes se comunicam de forma eficaz, eles podem duplicar trabalho, ordenar tarefas incorretamente ou perder dependências porque nenhum estado externo rastreia quem prometeu o quê. O autor construiu um Commitment Ledger usando apenas a biblioteca padrão do Python para registrar os compromissos dos agentes—como 'eu vou construir o arquivo de items'—como estado explícito.

Este ledger verifica conflitos, trabalhos perdidos e retrabalho sem exigir bancos de dados ou APIs. Nos testes, ele evitou trabalho duplicado e falhas de dependência, mas não corrigiu casos em que os agentes não conseguiram concluir tarefas ou relataram trabalho não verificado. O ledger melhora o estado de coordenação, mas não pode garantir o cumprimento pelos agentes.

A ideia vem do benchmark Cooper Bench da Stanford e SAP Labs, que mostrou que pares de agentes cooperantes às vezes pontuavam pior do que um único agente devido a mensagens vagas, suposições incorretas e compromissos desviados. Embora a coordenação seja possível—como visto em execuções minoritárias onde os agentes negociaram papéis ou dividiram recursos—ela não é confiável sem um mecanismo para persistir compromissos. O ledger isola esse modo específico de falha: compromissos existindo apenas no chat, sem maneira de outros agentes verificá-los posteriormente.

A solução é leve, determinística e focada apenas em tornar os compromissos visíveis e verificáveis.