HeadlinesBriefing favicon HeadlinesBriefing.com

Continuité d'intention pour les agents de codage

Towards Data Science •
×

J'ai construit un système qui découvre, vérifie et applique automatiquement les exigences pertinentes des interactions antérieures sans demander à l'utilisateur d'où elles viennent.

La leçon centrale : le simple fait de remonter l'historique passé n'équivaut pas à savoir ce qui est réellement encore exact. Une configuration de recherche de base n'a capturé que 57% des exigences dont un agent de codage avait besoin. L'ajout d'une couche de vérification a porté ce chiffre à 100%.

Sur 8 tâches, la référence n'en a réussi aucune, la recherche de base en a réussi 4, et la recherche consciente de l'intention a réussi les 8. J'ai fait tout cela avec zéro embeddings, zéro bases de données vectorielles, et absolument aucun appel LLM dans le pipeline.

J'ai mis en place un flux de travail d'agent de codage qui fonctionnait parfaitement au début. Mais une fois qu'un projet est devenu suffisamment long, il a commencé à causer des problèmes. Lorsqu'un projet dépassait quelques dizaines d'étapes, les règles fondamentales commençaient à disparaître. Personne ne les a supprimées. La fenêtre de contexte n'était pas pleine. Ces règles étaient encore techniquement présentes dans les journaux de chat. Elles ont simplement disparu du radar parce que les nouvelles demandes ne déclenchaient pas la vérification par l'agent si une décision plus ancienne comptait encore.

Par exemple, vous pourriez dire à l'agent le premier jour de ne jamais exposer les identifiants internes de base de données dans les réponses API. Soixante messages plus tard, vous lui demandez de construire un nouveau flux d'authentification. Cette nouvelle demande ne dit rien sur les identifiants. Comme l'agent manque d'une raison claire de regarder en arrière, il saute cette étape et livre un point de terminaison qui fuit exactement les données que vous avez tenté de protéger.

Ce n'est pas un scénario inventé. C'est le cas de test réel que j'ai utilisé pour cet article. Ci-dessous, je vais vous montrer comment trois méthodes différentes gèrent ce problème exact.

FAQ : Qu'est-ce que la continuité d'intention dans les agents de codage ?

La continuité d'intention signifie porter une ancienne exigence dans une nouvelle tâche sans que l'utilisateur la répète, tout en abandonnant cette règle si quelque chose de plus récent la remplace.

FAQ Q : Qu'est-ce que la continuité d'intention dans les agents de codage ?

FAQ A : La continuité d'intention signifie porter une ancienne exigence dans une nouvelle tâche sans que l'utilisateur la répète, tout en abandonnant cette règle si quelque chose de plus récent la remplace.