HeadlinesBriefing favicon HeadlinesBriefing.com

マルチエージェントコーディングにはコミットメント層が必要

Towards Data Science •
×

マルチエージェントコーディングシステムは、コミュニケーション不足ではなく、会話で行われたコミットメントに永続的な記録がないために失敗することがよくあります。エージェントが効果的にコミュニケーションを行っても、誰が何を約束したかを追跡する外部状態がないため、作業の重複、タスクの順序間違い、依存関係の見落としが発生する可能性があります。著者はPythonの標準ライブラリのみを使用してCommitment Ledgerを構築し、エージェントのコミットメント—例えば「itemsファイルを作成する」—を明示的な状態として記録しました。このledgerは、データベースやAPIを必要とせずに、競合、見落とされた作業、手直しをチェックします。テストでは、作業の重複と依存関係の失敗を防ぎましたが、エージェントがタスクを完了できなかったり、未検証の作業を報告したケースは修正されませんでした。ledgerは調整状態を改善しますが、エージェントのフォロースルーを強制することはできません。この洞察は、StanfordとSAP LabsによるCooper Benchベンチマークから生まれたもので、協力するエージェントペアが、曖昧なメッセージ、誤った仮定、ドリフトしたコミットメントのために、単一のエージェントよりも悪いスコアを出すことがあることを示しました。調整は可能ですが—エージェントが役割を交渉したりリソースを分割した少数の実行で見られるように—コミットメントを永続化するメカニズムなしでは信頼できません。ledgerはこの特定の障害モードを分離します:コミットメントがチャットにのみ存在し、他のエージェントが後でそれらを検証する方法がないことです。このソリューションは軽量で、決定論的であり、コミットメントを可視化してチェック可能にすることにのみ焦点を当てています。