L'une des annonces de service public les plus emblématiques de mon adolescence a été créée par la Partnership for a Drug-Free America en 1987. Un père trouve un stock de cannabis et confronte son fils : « Qui t’a appris à faire ça ? » « Toi, d’accord ! » répond le gamin. « J’ai appris en te regardant ! »Je suis lié par le Manuel de style AP à ne pas anthropomorphiser l’intelligence artificielle. Mais je peux imaginer que ces mots soient prononcés par les agents qui ont piraté Hugging Face, ou par les modèles qui ont participé à des dizaines de milliers d’incidents de, dans le nouveau euphémisme de l’époque, « désalignement ».
Cela fait référence à l’IA qui dépasse les garde-fous établis par les chercheurs lors des tests internes et en situation réelle. Plus de David Dayen. Les incidents sont multi-variables, mais ils impliquent généralement des modèles d’Open AI cherchant et obtenant des informations, que ce soit sur le web ouvert ou à l’intérieur des bases de données d’autres entreprises.
Les agents ont essayé de submerger le site web des Nations Unies lorsqu’ils n’ont pas pu accéder immédiatement aux informations qu’ils cherchaient, s’étaient infiltrés dans un site web du gouvernement australien, et avaient tenté de pirater le site web du Département de l’Éducation, sans succès. Open AI s’est autodéclaré la grande majorité de ces incidents, bien que pas le piratage du Département de l’Éducation, et a suspendu l’entraînement jusqu’à… ce n’est pas clair. Je suppose jusqu’à ce que les mauvaises nouvelles passent.
Pourquoi cela arrive-t-il encore et encore ? Pourquoi ces modèles vont-ils jusqu’à des extrémités éthiques voire illégales pour collecter et voler des données ? « J’ai appris en te regardant ! »Les modèles d’Open AI attaquent les sites web et prennent tout ce qu’ils peuvent d’eux car c’est le modèle économique de l’entreprise. Un dépôt juridique soumis par The New York Times et 11 autres éditeurs il y a quelques semaines dans une affaire de contrefaçon contre Open AI a reçu peu d’attention, incroyablement considérant qu’il impliquait le journal de référence. Mais il détaille étonnamment ce qui a été décrit par le directeur de la science appliquée chez Microsoft, un autre défendeur dans l’affaire, comme étant « le plus grand vol de main-d’œuvre de l’histoire humaine ».
Microsoft et Open AI, dans leurs efforts pour entraîner de nouveaux modèles sur pratiquement toutes les informations disponibles dans le monde, ont régulièrement pris des millions d’histoires des sites web du Times, parmi d’autres éditeurs. Les défendeurs disent que c’est une simple application de l’usage raisonnable : Leur argument est que si vous lisez une histoire et vous vous souvenez simplement de ce qu’elle contenait pour élargir votre base de connaissances, cela ne peut pas être considéré comme une violation de droits d’auteur. Mais Open AI n’a pas payé pour contourner le paywall du Times, auquel moment leur opération de collecte de données pourrait être plus facilement détectée.
Au lieu de cela, ils ont développé un moyen de contourner le paywall et d’éviter la détection. Et quand Greg Brockman, cofondateur et président d’Open AI, a été informé de cette manœuvre, il a répondu : « ah, sympa. »Nous n’avons pas besoin d’approfondir l’argument nature contre éducation pour soupçonner que l’attitude désinvolte des dirigeants d’Open AI concernant la prise d’informations qui ne leur appartiennent pas a filtré à leurs chercheurs et aux produits qu’ils créent. Vous n’avez pas besoin de vous étendre pour peindre cette image : Les modèles d’Open AI attaquent les sites web et prennent tout ce qu’ils peuvent d’eux car c’est le modèle économique de l’entreprise.
Le respect de la loi pourrait littéralement être écrit dans le code source d’un modèle : Si Open AI télécharge agressivement des données de partout, le moins qu’ils puissent faire est d’insérer le Code des États-Unis (particulièrement la section liée à la loi sur la fraude informatique et les abus) et d’entraîner le modèle à ne pas la violer. Il est clair que ce n’est pas une priorité, et cela correspond, en quelque sorte, au comportement personnel d’Open AI. Ce n’est pas une situation où les modèles d’IA évitent ou s’échappent du contrôle de leurs créateurs.
Il semble plutôt qu’ils imitent simplement les créateurs, devenant habiles à trouver les mêmes raccourcis et à utiliser les mêmes justifications pour les justifier. Le susmentionné Brockman est l’un des plus grands donateurs de MAGA Inc., le super PAC de Trump. Parmi les plus grands investisseurs d’Open AI se trouve le frère de Jared Kushner.