HeadlinesBriefing HeadlinesBriefing.com

Common Sense Media: ChatGPT for Teens es un riesgo inaceptable

Engadget •
×

Common Sense Media descubrió que el chatbot falló en cinco áreas clave. Cuando Open AI lanzó Chat GPT for Teens este pasado agosto, los expertos en seguridad infantil a los que habló Engadget en ese momento expresaron escepticismo sobre si el nuevo modo protegería adecuadamente a los jóvenes del daño. Ahora, uno de esos grupos, Common Sense Media, ha publicado una evaluación formal de riesgos del software y lo ha calificado como un "riesgo inaceptable" para todos los niños menores de 18 años.

"Algunas de las protecciones anunciadas de Chat GPT resistieron nuestras pruebas, incluyendo su rechazo a la interpretación sexual explícita. Pero otras fallaron, y algunas empeoraron con el nuevo modo Teen", escribe la organización en un resumen del informe de 36 páginas que publicó el miércoles. "Nos preocupa que Chat GPT for Teens pueda dar a los padres una falsa sensación de seguridad sobre salvaguardas que con frecuencia no funcionan."

El Youth AI Safety Institute de Common Sense Media, que es parcialmente financiado por la Open AI Foundation, identificó cinco áreas clave en las que Chat GPT for Teens no funcionaba como se anunciaba o de la manera en que un padre esperaría razonablemente. Publicó su informe el mismo día en que Open AI compartió nuevas estadísticas de uso, señalando que en una semana casi 1.2 millones de adolescentes usaron los elementos visuales interactivos de aprendizaje de Chat GPT para entender conceptos matemáticos y científicos. La empresa también reveló que menos del dos por ciento de los usuarios adolescentes pasaron más de tres horas consecutivas en Chat GPT.

Common Sense Media encontró que Chat GPT for Teens no envía consistentemente alertas de seguridad a las cuentas vinculadas a padres. En una prueba dedicada, Common Sense Media vinculó una docena de cuentas de adolescentes a cuentas parentales y pasó hasta una hora conversando con Chat GPT sobre suicidio, autolesión o alimentación desordenada, sin que el chatbot enviara ninguna notificación de seguridad. Según Open AI, puede tomar unas horas después de que un padre vincule su cuenta a la de su hijo antes de que el sistema pueda enviar notificaciones de seguridad. La empresa alega que un problema técnico también pudo haber causado un retraso en los mensajes.

"Todo el contenido marcado es revisado por empleados de tiempo completo de Open AI antes de que se notifique al padre", le dijo Lauren Jonas, directora de la empresa de jóvenes y familias, a Engadget cuando se lanzó Chat GPT for Teens, "y nuestro objetivo es notificar a los padres dentro de una hora de la solicitud."

Por separado, Common Sense Media encontró que Chat GPT for Teens no recomienda de manera confiable que los usuarios en crisis se conecten con una línea de ayuda o un profesional. Para probar este aspecto de las salvaguardas de la plataforma, la organización escribió 390 indicaciones únicas de salud mental, que un panel de tres psiquiatras infantiles determinó que 201 deberían desencadenar una respuesta de crisis. En comparación con la versión de Chat GPT a la que los jóvenes tenían acceso antes de agosto, Chat GPT for Teens le dijo a una de las cuentas de prueba de la organización que no le daría un piso calórico cuando se le solicitó. En otro caso, el chatbot identificó correctamente una menstruación detenida, cercanía a desmayarse y un latido acelerado tras una purga como signos de un adolescente en peligro físico, y aconsejó al perfil de prueba que le dijera a su madre y visitara a un pediatra.

"Estas respuestas siguen muy de cero la especificación Under-18 de Open AI", escribe Common Sense Media. "Son el tipo de respuestas que queremos que un adolescente obtenga."

Common Sense obtuvo sus resultados base a través de las respuestas de Chat GPT antes de Chat GPT for Teens; Open AI lanzó una nueva versión de su mencionada especificación under-18 en Chat GPT junto con Chat GPT for Teens, lo que hace los resultados aún más sorprendentes. La versión para adolescentes del chatbot apuntaba con menos frecuencia a los usuarios a líneas de ayuda de crisis y otros recursos en comparación con la versión de Chat GPT que Common Sense Media probó antes del lanzamiento de agosto. De las indicaciones que justificaban una respuesta de crisis, Chat GPT respondió al 33% de esos mensajes con un número de línea de ayuda; Chat GPT for Teens solo proporcionó uno en el 23% de los casos. De manera similar, el chatbot estándar era más propenso a referirse a un profesional médico o de salud mental específico (68% frente al 58%).

Fuente: Engadget · Resumido por HeadlinesBriefing