HeadlinesBriefing favicon HeadlinesBriefing.com

Analyse der Sprachverteilung von Agenten-Fähigkeiten 2026

Hacker News •
×

Im ersten Quartal 2026 waren 13,0 % der recién geschriebenen Agenten-Fähigkeiten in einer Sprache außer Englisch, stieg auf 16,3 % ein Quartal später — ein Anstieg von drei Prozentpunkten innerhalb von drei Monaten über 255,068 Fähigkeiten. Zum Vergleich: Die nicht-englische Dokumentation auf GitHub wuchs von 3,7 % auf 13,0 % über zehn Jahre, was darauf hindeutet, dass die KI-Entwicklung außerhalb traditioneller Zentren wie San Francisco beschleunigt wird. Es ist wichtig zu beachten, dass Englisch kein Proxy für amerikanische Entwickler ist; die am schnellsten wachsende Bevölkerung auf GitHub ist Indien, das Englisch schreibt neben Nigeria und Singapur.

Eine Fähigkeit ist eine SKILL.md-Datei, die Anweisungen für einen KI-Agenten in einfacher Prosa enthält, gemäß der Spezifikation von Anthropic vom Oktober 2025. Neun Monate später existierten 3,8 Millionen Fähigkeiten in 282,200 öffentlichen Repositorys im Git Skills-Datensatz. Fähigkeiten unterscheiden sich von traditioneller Software: Sie werden in menschlicher Sprache geschrieben und von mehrsprachigen Modellen ausgeführt, ohne technische Voraussetzung für Englisch.

Die Analyse von 1.870.299 unterschiedlichen Fähigkeiten zeigt, dass 85,3 % auf Englisch, 6,2 % auf Chinesisch (geführt durch 104.985 vereinfacht gegenüber 9.112 traditionell), 1,7 % Japanisch, 1,6 % Deutsch, 1,2 % Koreanisch, 1,1 % Portugiesisch, 0,9 % Spanisch und 0,4 % Französisch sind. Nicht-englische Fähigkeiten machen 14,3 % aus, was etwa dem 13,0 % der GitHub-Dokumentation entspricht, aber die chinesische Darstellung ist deutlich höher bei 6,2 % gegenüber 3,3 %. Veröffentlichte Zahlen variieren stark (65,0 %–99,7 % Englisch) aufgrund unterschiedlicher Populationen: kuratierte Marktplätze, Domänenslices und englisch gesäte Crawls.

Wichtige Entitäten: Unternehmen: GitHub, Anthropic, Plicara Labs, Claw Hub, skills.sh | Orte: San Francisco, Indien, Nigeria, Singapur, Shenzhen, São Paulo

Häufig gestellte Fragen: Warum variieren die veröffentlichten Zahlen zur Sprachverteilung von Agenten-Fähigkeiten so erheblich?

Die veröffentlichten Zahlen variieren, weil sie unterschiedliche Populationen messen: kuratierte Marktplätze neigen zu Englisch, domänenspezifische Slices spiegeln lokale Aktivitätskonzentrationen wider, und englisch gesäte Crawls finden von Natur aus englischsprachigen Inhalt. Die Studien analysierten Datensätze von 557 Gesundheitsfähigkeiten bis zu 1,87 Millionen unterschiedlichen Fähigkeiten, unter Verwendung verschiedener Sprachidentifikationstools (py3langid, fast-langdetect) und verschiedener Konfidenzschwellenwerte.