HeadlinesBriefing favicon HeadlinesBriefing.com

La codificación multi-agente necesita una capa de compromiso

Towards Data Science •
×

Los sistemas de codificación multi-agente a menudo fallan no por mala comunicación, sino porque los compromisos hechos en conversación carecen de un registro persistente. Incluso cuando los agentes se comunican eficazmente, pueden duplicar trabajo, ordenar mal las tareas o pasar por alto dependencias porque ningún estado externo rastrea quién prometió qué. El autor construyó un Commitment Ledger usando solo la biblioteca estándar de Python para registrar los compromisos de los agentes—como 'construiré el archivo de items'—como estado explícito.

Este ledger verifica conflictos, trabajo omitido y retrabajo sin requerir bases de datos o APIs. En las pruebas, evitó trabajo duplicado y fallos de dependencia, pero no corrigió los casos en que los agentes no completaron tareas o reportaron trabajo no verificado. El ledger mejora el estado de coordinación pero no puede exigir el cumplimiento por parte de los agentes.

La idea proviene del benchmark Cooper Bench de Stanford y SAP Labs, que mostró que los pares de agentes cooperantes a veces obtenían peores resultados que un solo agente debido a mensajes vagos, suposiciones incorrectas y compromisos desviados. Aunque la coordinación es posible—como se ve en ejecuciones minoritarias donde los agentes negociaron roles o dividieron recursos—es poco confiable sin un mecanismo para persistir los compromisos. El ledger aísla este modo de fallo específico: compromisos que existen solo en el chat, sin forma de que otros agentes los verifiquen posteriormente.

La solución es ligera, determinista y se centra únicamente en hacer que los compromisos sean visibles y verificables.