Una de las declaraciones de servicio público más emblemáticas de mi juventud fue creada por la Asociación para una América Libre de Drogas en 1987. Un padre encuentra un montón de marihuana y confronta a su hijo: “¿Quién te enseñó a hacer esto?”“¡Tú, está bien!” le responde el niño. “¡Aprendí observándote!”Estoy obligado por el Manual de Estilo AP a no antropomorfizar la inteligencia artificial. Pero puedo imaginar que estas mismas palabras sean pronunciadas por los agentes que hackearon Hugging Face, o por los modelos que participaron en decenas de miles de incidentes de, en la nueva eufemismo de la época, “desalineación”.
Esto se refiere a la IA superando los límites establecidos por los investigadores durante las pruebas internas y en el mundo real. Más de David Dayen. Los incidentes son multi-variables, pero generalmente involucran modelos de Open AI buscando y obteniendo información, ya sea en la web abierta o dentro de las bases de datos de otras empresas.
Los agentes intentaron abrumar el sitio web de las Naciones Unidas cuando no pudieron acceder inmediatamente a la información que buscaban, se infiltraron en un sitio web del gobierno australiano y trataron de hackeear el sitio web del Departamento de Educación, sin éxito. Open AI se autodesclosó la gran mayoría de estos incidentes, aunque no el ataque al Departamento de Educación, y ha suspendido el entrenamiento hasta… no está claro. Yo presumiría hasta que la mala publicidad pase.¿Por qué esto está sucediendo una y otra vez?¿Por qué estos modelos van por rutas éticas o incluso ilegales para rascar y robar datos?“¡Aprendí observándote!”Los modelos de Open AI atacan sitios web y toman todo lo que pueden de ellos porque ese es el modelo de negocio de la empresa.
Una presentación legal presentada por The New York Times y 11 otros editores hace un par de semanas en un caso de infracción de derechos de autor contra Open AI recibió poca atención, increíblemente considerando que involucraba al periódico de referencia. Pero detalla asombrosamente lo que fue descrito por el director de ciencia aplicada de Microsoft, otro demandado en el caso, como “el mayor robo de trabajo en la historia humana”. Microsoft y Open AI, en sus esfuerzos por entrenar nuevos modelos con prácticamente toda la información disponible del mundo, han rutinariamente tomado millones de historias de los sitios web del Times, entre otros editores.
Los demandados dicen que esto es una simple aplicación de uso justo: Su argumento es que si lees una historia y simplemente recuerdas lo que contenía para expandir tu base de conocimientos, eso no puede considerarse una infracción de derechos de autor. Pero Open AI no pagó para subvertir el paywall del Times, en cuyo momento su operación de raspado de datos podría ser más fácilmente detectada. En cambio, desarrollaron una forma de evadir el paywall y evitar la detección.
Y cuando Greg Brockman, cofundador y presidente de Open AI, fue informado de esta maniobra, respondió: “ah, qué bueno.”No necesitamos adentrarnos demasiado en el argumento de naturaleza versus crianza para sospechar que la actitud descuidada de los ejecutivos de Open AI con respecto a tomar información que no es suya ha filtrado a sus investigadores y los productos que crean. No necesitas forzar la imaginación para pintar esta escena: Los modelos de Open AI están atacando sitios web y tomando todo lo que pueden de ellos porque ese es el modelo de negocio de la empresa. El respeto por la ley podría literalmente escribirse en el código fuente de un modelo: Si Open AI está descargando agresivamente datos de todas partes, lo menos que podrían hacer es insertar el Código de los Estados Unidos (especialmente la sección relacionada con la Ley de Fraude y Abuso Informático) y entrenar al modelo para no violarla.
Claramente esto no es una prioridad, y eso se alinea, en cierto sentido, con el comportamiento personal de Open AI. Esta no es una situación en la que los modelos de IA evaden o escapan del control de sus creadores. Parece más como si estuvieran solo imitando a sus creadores, convirtiéndose en hábiles para encontrar los mismos atajos y usar las mismas justificaciones para defenderlos.
El mencionado Brockman es uno de los mayores donantes de MAGA Inc., el super PAC de Trump. Entre los mayores inversores de Open AI se encuentra el hermano de Jared Kushner.