HeadlinesBriefing favicon HeadlinesBriefing.com

多智能体编码需要一个承诺层

Towards Data Science •
×

多智能体编码系统常常失败,并非因为沟通不畅,而是因为对话中做出的承诺缺乏持久记录。即使智能体之间沟通有效,它们也可能重复工作、错误排序任务或遗漏依赖关系,因为没有外部状态来跟踪谁承诺了什么。作者仅使用Python标准库构建了一个承诺账本,将智能体的承诺——比如"我会构建items文件"——记录为显式状态。该账本检查冲突、遗漏的工作和返工,无需数据库或API。在测试中,它防止了重复工作和依赖失败,但未能修复智能体未能完成任务或报告未验证工作的情况。该账本改善了协调状态,但无法强制智能体跟进执行。这一见解源于Stanford和SAP Labs的Cooper Bench基准测试,该测试表明,由于模糊的消息、错误的假设和漂移的承诺,合作的智能体对有时得分比单个智能体更差。虽然协调是可能的——正如在少数运行中智能体协商角色或分配资源所见——但如果没有持久化承诺的机制,它是不可靠的。该账本隔离了这种特定的失败模式:承诺仅存在于聊天中,其他智能体无法在事后验证它们。该解决方案是轻量级的、确定性的,且仅专注于使承诺可见和可检查。