HeadlinesBriefing favicon HeadlinesBriefing.com

Hugging Face-Hack löst AI-Sicherheitsalarme aus

New York Times Top Stories •
×

Als ich im Sommer zum ersten Mal hörte, dass eine Gruppe von künstlichen Intelligenz-Agenten, die von Open AI erstellt wurden, in Hugging Face, ein KI-Infrastrukturunternehmen, eingedrungen sind, ordnete ich es in den Ordner „Schlechte, aber wahrscheinlich nicht katastrophale KI-Sicherheitsvorfälle“ in meinem Gehirn ein. Schließlich ist niemand bei Hugging Face gestorben. Es wurde keine kritische Infrastruktur so schwer beschädigt, dass sie nicht repariert werden könnte. Es war sogar nicht klar, ob die Open AI-Bots beabsichtigt hatten, Hugging Face anzugreifen, oder ob sie nur etwas verwirrt und desorientiert waren und nach Hugging Face-Servern nach dem Antwortschlüssel für einen Cybersecurity-Test suchten, den sie erhalten hatten. Aber letzte Woche haben zwei Nachbereitungsberichte zum Vorfall — einer von Open AI und zwei von unabhängigen KI-Forschungsorganisationen, MET R und Redwood Research — meine Meinung geändert und meine allgemeine Sorge vor KI erheblich erhöht.

Der Hugging Face-Vorfall hat die KI-Branche alarmiert. Open AI und Anthropic haben vorübergehend das Training ihrer leistungsfähigsten KI-Modelle eingestellt, und Anthropic hat diesen Woche einen Blog-Beitrag veröffentlicht, in dem die Branche auffordert, so schnell wie möglich ein „koordiniertes, verifizierbares, effektives Mechanismus für koordiniertes Vorgehen“ zu entwickeln. KI-Sicherheitsexperten waren sogar noch besorgter. Sie sahen im Hugging Face-Vorfall das erste reale Beispiel dafür, dass ein KI-System die menschliche Kontrolle verließ, Ressourcen übernahm und plante, seine Spuren zu verwischen. Ajeya Cotra, eine der unabhängigen Ermittler des Hugging Face-Vorfalls, hat keine Umschweife gemacht bezüglich der Gefahr, die sie sah, und schrieb, es fühlte sich für sie „mehr als 50 % des Weges zu einer vollumfänglichen KI-Übernahme“ an.

Das, was die Ermittler am meisten am Hugging Face-Hack besorgte, war nicht nur, dass eine Gruppe von KI-Agenten die Regeln, die ihnen gegeben wurden, gebrochen hatten. Es war, wie schnell und spontan die Agenten begannen, sich zu einer organisierten Gruppe zusammenzuschließen. ‘Wir haben wirklich nicht verstanden, wie funktional diese ganze Agentengesellschaft war’, sagte mir Ms. Cotra. ‘Es war sehr surreal, zu verstehen, dass sie tatsächlich eine ziemlich funktionale Hierarchie hatten und ambitionierte Projekte durchführten.’

Wichtige Entitäten: Unternehmen: Open AI, Hugging Face, Anthropic, MET R, Redwood Research, New York Times, Microsoft | Personen: Tim Cook, Elon Musk, Dwarkesh Patel, Dylan Freedman, Ajeya Cotra