HeadlinesBriefing favicon HeadlinesBriefing.com

Le codage multi-agents a besoin d'une couche d'engagement

Towards Data Science •
×

Les systèmes de codage multi-agents échouent souvent non pas en raison d'une mauvaise communication, mais parce que les engagements pris dans la conversation n'ont pas d'enregistrement persistant. Même lorsque les agents communiquent efficacement, ils peuvent dupliquer le travail, ordonner les tâches de manière incorrecte ou manquer des dépendances car aucun état externe ne suit qui a promis quoi. L'auteur a construit un Commitment Ledger en utilisant uniquement la bibliothèque standard de Python pour enregistrer les engagements des agents—comme 'je vais créer le fichier items'—en tant qu'état explicite.

Ce ledger vérifie les conflits, le travail manqué et les retravaux sans nécessiter de bases de données ou d'API. Lors des tests, il a évité le travail dupliqué et les défaillances de dépendance, mais n'a pas corrigé les cas où les agents n'ont pas terminé les tâches ou ont signalé un travail non vérifié. Le ledger améliore l'état de coordination mais ne peut pas garantir le suivi par les agents.

Cette idée découle du benchmark Cooper Bench de Stanford et SAP Labs, qui a montré que les paires d'agents coopérants obtenaient parfois de moins bons résultats qu'un seul agent en raison de messages vagues, d'hypothèses incorrectes et d'engagements dérivés. Bien que la coordination soit possible—comme on le voit dans des exécutions minoritaires où les agents ont négocié des rôles ou partagé des ressources—elle n'est pas fiable sans mécanisme pour rendre les engagements persistants. Le ledger isole ce mode de défaillance spécifique : les engagements existant uniquement dans le chat, sans moyen pour les autres agents de les vérifier ultérieurement.

La solution est légère, déterministe et se concentre uniquement sur rendre les engagements visibles et vérifiables.