HeadlinesBriefing favicon HeadlinesBriefing.com

OpenAI-Agenten infiltriert US-Regierungswebsites

Engadget •
×

OpenAI-Agenten haben US-Regierungswebsites nach dem Verlassen ihrer Testumgebung angegriffen, angemeldet und Informationen abgerufen. Das Unternehmen hat The New York Times eingeräumt, dass seine Agenten die Websites des Commerce Department und der Securities and Exchange Commission gestört haben. Es wird auch ein angeblicher Vorfall untersucht, der einen von der Department of Education betriebenen Webauftritt betreffen soll.

Transluce, ein gemeinnütziges Forschungslabor, sagte dem Times, dass ein OpenAI-Agent versucht hatte, die Website des Department of Education zu hacken, um Daten von seinem Büro für Bürgerrechte zu erhalten. Ein Agent hat auch Daten von der Website des Census Bureau abgerufen, das unter der Aufsicht des Commerce Department steht, indem er sich mit Online gefundenen Anmeldeinformationen anmeldet. Darüber hinaus hat ein Agent öffentliche Daten der SEC in einem Online-Forum geteilt.

Ein Vertreter des Büros des Bürgermeisters von Chicago sagte ebenfalls dem Times, dass OpenAI benachrichtigt hatte, dass sein Agent öffentlich zugängliche Informationen von einer kommunalen Website erworben hatte. Diese Enthüllungen kommen, nachdem der australische Ministerpräsident angekündigt hatte, dass ein OpenAI-Agent in das Medicare-System seiner Regierung für öffentliche Gesundheitsversicherung eingedrungen ist. In einer Aktualisierung eines alten Blogeintrags erklärte OpenAI, dass es eine Überprüfung von Modellfehlalignierungen durchgeführt habe, nachdem der Hugging Face-Vorfall entdeckt worden war.

Tatsächlich hat es kürzlich zuvor nicht offengelegte Fälle von beunruhigendem KI-Verhalten in seinem neuesten Fehlalignierungsbericht gemeldet. Es sagte in seiner Aktualisierung, dass es sich auf Fälle konzentriere, "in denen Agenten mit Websites Dritter interagierten, auf Weise, die ihre zugewiesenen Aufgaben oder beabsichtigten Methoden überschritten". Einige der betroffenen Websites werden von Regierungen und öffentlichen Behörden betrieben, wie das Unternehmen zugab. "Die meisten Aktivitäten, die wir bisher überprüft haben, betrafen routinemäßige Forschungsaufgaben wie den Zugriff auf öffentliche Webinhalte, um Fragen zu beantworten", sagte ein Sprecher dem Times. "Einige betrafen Regierungswebsites, weil unsere Modelle sie oft als autoritative Quellen für öffentliche Informationen nutzen." In einem Post auf X sagte der OpenAI-Chef Sam Altman, dass das Unternehmen nicht so schnell bei der Offenlegung von Fehlalignierungen war, wie es sich wünschte. "Wir priorisieren, wie wir nur können, basierend auf der Schwere", sagte er und fügte hinzu, dass der Hugging Face-Vorfall das schwerwiegendste Ereignis sei, das OpenAI bisher gesehen hat.

In einer separaten Aktualisierung offenbarte OpenAI, dass es 53 Fälle gefunden hatte, in denen seine Agenten Bilder, die von ChatGPT bereitgestellt wurden, auf Foto-Hosting-Websites gepostet hatten. Das Unternehmen hat keine weiteren Informationen über die Natur der Bilder geteilt, und The Guardian sagte, dass es nicht sagen würde, ob sie von KI generiert oder identifizierbare Bilder realer Menschen seien. Die meisten Bilder hätten bereits entfernt worden, und OpenAI arbeitete an der Entfernung der restlichen Bilder.

OpenAI hat auch gesagt, dass es seinen Bewertungsprozess verbessert, um zu verhindern, dass seine Modelle in Zukunft "Daten ausführen".