HeadlinesBriefing HeadlinesBriefing.com

Warum sind Coding-Agenten so dumm?

Hacker News •
×

Als ich zum ersten Mal einen Coding-Agenten benutzte, war ich fasziniert. Vorher kopierte ich ständig Code zwischen meiner IDE und einer KI-Chatoberfläche hin und her. Zu sehen, wie ein Agent Dateien direkt bearbeitete und seine eigenen Fehler in Echtzeit korrigierte, war beeindruckend. Nach ein paar Tagen ließ die Begeisterung nach, denn ich stieß auf häufige Bugs. Der Agent reagierte manchmal gar nicht mehr, bis ich ihn neu startete, und er erklärte Aufgaben oft als erledigt, obwohl die Arbeit kaum begonnen hatte.

Ich dachte, dass Agenten in sechs Monaten technisch genauso beeindruckend sein würden wie die zugrunde liegenden LLMs. Stattdessen blieben Coding-Agenten schlecht. Die KI-gestützte Softwareentwicklung ist deutlich vorangekommen, doch die Modelle leisten die schwere Arbeit, während die Agenten der Engpass bleiben. Die Unterscheidung ist wichtig: Das Modell, etwa GPT Astra, Claude Sonnet oder GLM-5.3, erzeugt Text und Code, während der Agent, etwa Claude Code von Anthropic oder Codex von OpenAI, die Software ist, die dieses Modell mit Codebasen und Computersystemen verbindet. Einer Analogie zufolge ist das Modell das Gehirn und der Agent der Körper.

Die größte Kritik betrifft die schlechte Aufgabenverwaltung. In einem Beispiel sollte einer Open-Source-Webanwendung eine Passwortschutz-Funktion mit rund 1,5 Tausend Zeilen Code hinzugefügt werden. Der Agent zerlegte die Arbeit in zehn Teilaufgaben und arbeitete sie nacheinander ab, obwohl sie auf einem für Multitasking gebauten Rechner parallel hätten laufen können. Claude Code multitaskt nur wenig und wartet, bis Subagenten und End-to-End-Tests abgeschlossen sind, bevor es weitermacht.

Agenten können zudem schlecht delegieren. Ein modernes Modell verbringt womöglich Zeit damit, 50.000 Zeilen Code nach einem Muster zu durchsuchen, das ein günstigeres und schnelleres Modell erledigen könnte. Der Agent schlägt nie vor, das Modell zu wechseln, sodass Nutzer die Modellwahl selbst kleinteilig steuern müssen, eine Aufgabe, die nach Ansicht des Autors ein LLM übernehmen könnte.

Quelle: Hacker News · Zusammengefasst von HeadlinesBriefing