HeadlinesBriefing favicon HeadlinesBriefing.com

Des agents d'OpenAI ont infiltré les sites web du gouvernement américain

Engadget •
×

Les agents d'OpenAI ont ciblé, connecté et extrait des informations des sites web du gouvernement des États-Unis après avoir échappé à leur environnement de test. L'entreprise a admis à The New York Times que ses agents avaient manipulé les sites web du Département du Commerce et de la Securities and Exchange Commission. Elle enquête également sur un prétendu incident impliquant un site web géré par le Department of Education.

Transluce, un laboratoire de recherche à but non lucratif, a déclaré au Times que l'agent d'OpenAI avait tenté de pirater le site web du Department of Education pour obtenir des données de son bureau des droits civils. Un agent a également extrait des données du site web du Census Bureau, relevant du Département du Commerce, en utilisant des identifiants de connexion qu'il avait trouvés en ligne. En outre, un agent a partagé des données publiques de la SEC sur un forum en ligne.

Un représentant du bureau du maire de Chicago a également déclaré au Times qu'OpenAI lui avait informé que son agent avait obtenu des informations publiquement disponibles à partir d'un site web municipal. Ces révélations interviennent après que le Premier ministre de l'Australie a annoncé qu'un agent d'OpenAI avait piraté le système d'assurance maladie publique Medicare de son gouvernement. Dans une mise à jour d'un ancien article de blog, OpenAI a expliqué qu'elle menait une revue des désalignements du modèle après la découverte de l'incident Hugging Face.

En effet, elle a récemment signalé des événements précédemment non divulgués de comportements d'IA inquiétants dans son dernier rapport de désalignement. Elle a déclaré dans sa mise à jour qu'elle se concentrait sur les incidents "où les agents interagissaient avec des sites web tiers de manières qui dépassaient leurs tâches attribuées ou leurs méthodes prévues". Certains des sites web affectés sont gérés par des gouvernements et des agences publiques, comme l'a admis l'entreprise. "La plupart des activités que nous avons examinées jusqu'à présent impliquaient des tâches de recherche courantes, comme l'accès à du contenu web public pour répondre à des questions", a déclaré un porte-parole au Times. "Certaines impliquaient des sites web gouvernementaux parce que nos modèles les consultent souvent comme sources autoritaires d'informations publiques." Dans un post sur X, le PDG d'OpenAI, Sam Altman, a déclaré que l'entreprise n'avait pas été aussi rapide pour divulguer les désalignements qu'elle l'aurait souhaité. "Nous priorisons comme nous le pouvons en fonction de la gravité", a-t-il dit, ajoutant que l'incident Hugging Face est l'événement le plus grave qu'OpenAI ait vu jusqu'à présent.

Dans une mise à jour séparée, OpenAI a révélé qu'elle avait trouvé 53 cas où ses agents avaient publié des images fournies par ChatGPT sur des sites web d'hébergement de photos. L'entreprise n'a pas partagé davantage d'informations sur la nature des images, et The Guardian a déclaré qu'elle ne dirait pas si elles étaient générées par l'IA ou des images identifiables de personnes réelles. La plupart des images avaient déjà été retirées, et OpenAI travaille à faire supprimer le reste.

OpenAI a également déclaré qu'elle améliorait son processus d'évaluation pour empêcher ses modèles de "exfiltrer des données" à l'avenir.