HeadlinesBriefing favicon HeadlinesBriefing.com

Warp baut selbstverbessernde Agenten auf Claude-Plattform

Hacker News •
×

Warp, die KI-gestützte Terminal- und Entwicklungsumgebung, hat eine selbstverbessernde Agentenarchitektur auf der Claude-Plattform aufgebaut, um wiederkehrende Aufgaben zuverlässig zu lösen. 2020 von Zach Lloyd gegründet, Warp steht vor dem allgemeinen Problem, dass ein Prompt im ersten Durchlauf, der 80% der Aufgabenkorrektheit erreicht, ein lautes Benutzererlebnis erzeugt. Das Team versuchte zunächst, Prompts manuell umzuschreiben und Kontextdateien zu verbessern, stellte jedoch fest, dass diese Lösungen nicht skalierbar sind. Das zentrale Problem war, dass Feedback für Agenten typischerweise verschwindet, wenn Sitzungen enden, wodurch kritischer Kontext aus der Agentenschleife entfernt wird.

Die Lösung von Warp ist ein Agent Skills-basiertes Framework, in dem Feedback im Laufe der Zeit akkumuliert, um die Agentenausgabe zu verfeinern. Die Architektur besteht aus zwei Fähigkeitstypen: einer inneren/Grundfertigkeit, die funktionale Domänenkenntnisse und Anweisungen enthält, und einer äußeren/Verbesserungsfertigkeit, die als beobachtender Agent agiert. Der Verbesserer läuft nach einem Zeitplan, zieht akkumuliertes menschliches Feedback und vergleicht Agentenvorschläge mit menschlichen Antworten, um gezielte Bearbeitungen am Grundfertigkeit vorzuschlagen.

Da Fähigkeiten einfache Dateien sind, sind Aktualisierungen überprüfbar, genehmigbar und über normale PR-Workflows zusammenführbar. Sobald sie zusammengeführt wurden, erbt der nächste Lauf der inneren Fähigkeit die Verbesserung. Warp führt nun dieses Muster in seinem gesamten Open-Source-Repository mit separaten Agenten für Spezifikationsschreibung, Überprüfung und Priorisierung durch, wobei jeder seine eigene Selbstverbesserungsschleife hat.

Das Framework ermöglicht akkumulative Verbesserungen ohne die rohen Prompts zu verschmutzen und schafft einen nachhaltigen Weg zu zunehmend zuverlässiger KI-gestützter Entwicklung.