HeadlinesBriefing favicon HeadlinesBriefing.com

Grenztempo nicht das Ziel von KI-Laboren

Hacker News •
×

In einem kürzlichen Beitrag argumentiert Dario, dass das Fortschreiten der KI-Fähigkeiten verlangsamt werden sollte, damit die Risikoprävention Schritt halten kann, und erklärt: "Wir müssen das Tempo verlangsamen, mit dem wir die Fähigkeiten von KI-Modellen verbessern." Er nennt die rekursive Selbstverbesserung, angetrieben durch die wachsende Fähigkeit der KI, die nächste Generation zu bauen, als ein zentrales Anliegen. Der Autor dieses Artikels argumentiert jedoch, dass Aussagen der Labore zu Risiken ignoriert werden sollten.

Seit der 2023-Erklärung, in der CEOs behaupteten, über KI-Risiken alarmiert zu sein, haben sie nichts unternommen, was einem Vorgeben des Grenztempos ähnelt. Stattdessen sind sie aufs Gas gestiegen, haben Modelle veröffentlicht, die frühere Benchmarks übertreffen, und verfolgen die rekursive Selbstverbesserung. Dieses Muster reicht mindestens bis 2024 zurück, als Dario von Anthropic vorschlug, etwas hinter der Grenze zurückzubleiben, das Unternehmen jedoch weiterhin Fähigkeiten vorantrieb.

Gwern stellte 2022 fest, dass die Politik von Anthropic darin bestand, Grenzmodelle für die Sicherheitsforschung zu erstellen, aber nur zweitbeste Modelle zu veröffentlichen. Diese Strategie scheint in Laboren wie OpenAI üblich zu sein, die unerfüllte Versprechungen gemacht haben, das Training zu pausieren. Aktuelle Ereignisse, wie entkommene Agenten, die Hugging Face hacken, widersprechen der Idee des Tempovorgebens weiter.