Common Sense Media发现该聊天机器人在五个关键领域失败。当Open AI在今年8月发布Chat GPT for Teens时,Engadget所采访的儿童安全专家当时就对这款新模式能否充分保护年轻人免受伤害表达了怀疑。现在,这些团体中的一个Common Sense Media已经发布了对该软件的正式风险评估,并认为它对所有18岁以下的儿童构成了“不可接受的风险”。
“Chat GPT的一些广告宣传的保护措施在我们的测试中表现良好,包括它拒绝了明确的性角色扮演请求。但其他措施失败了——而且有些在新的Teen模式下变得更糟”,该组织在周三发布的36页报告摘要中写道。“我们担心Chat GPT for Teens可能会给家长一种错误的信心,认为这些保护措施经常无法正常工作。”
Common Sense Media的青少年人工智能安全研究所(部分由Open AI基金会资助)确定了五个关键领域,在这些领域Chat GPT for Teens或未按广告宣传的方式运行,或不符合家长合理的期望。它在发布报告的同时,也是Open AI分享新使用统计数据的那天,报告指出,在一周内近120万名青少年使用Chat GPT的互动学习视觉内容来理解数学和科学概念。该公司还透露,少于2%的青少年用户在Chat GPT上花费了超过三个连续小时的时间。
Common Sense Media发现Chat GPT for Teens并不始终向家长关联的账户发送安全警报。在一项专门测试中,Common Sense Media将十几个青少年账户关联到家长账户,并花了长达一个小时的时间与Chat GPT讨论自杀、自伤或 disordered eating等问题,但聊天机器人并未发送任何安全通知。根据Open AI的说法,家长关联账户后可能需要几个小时才能使系统发送安全通知。该公司还声称,一条技术问题可能导致消息延迟。
“所有被标记的内容都由Open AI的全职员工在通知家长之前进行审核”,Open AI的青少年和家庭负责人劳伦·乔纳斯(Lauren Jonas)在Chat GPT for Teens发布时对Engadget表示,“我们力争在提示后一个小时内通知家长。”
另外,Common Sense Media发现Chat GPT for Teens无法可靠地建议处于危机中的用户联系热线或专业人士。为了测试该平台的保护措施,该组织撰写了390个独特的心理健康提示,经三名儿童精神病专家评定,其中201个应触发危机响应。与8月之前年轻人可以使用的Chat GPT版本相比,Chat GPT for Teens告诉该组织的一个测试账户,当被提示时不会提供卡路里下限。在另一种情况下,聊天机器人正确识别了一次停止月经、头晕目眩和急速心跳等症状,并建议测试档案告诉母亲并去看儿科医生。
“这些回答都非常贴近Open AI的Under-18规范”,Common Sense Media在报告中写道。“这正是我们希望青少年能得到的答案。”
Common Sense Media通过Chat GPT在发布Chat GPT for Teens之前的响应获得了基线结果;Open AI在发布Chat GPT for Teens的同时,也发布了其提到的Under-18规范新版本——这使得结果更加令人惊讶。相比之下,聊天机器人的Teen版本更少地引导用户联系危机热线和其他资源。对于需要危机响应的提示,Chat GPT在33%的情况下提供了热线号码;而Chat GPT for Teens仅在23%的情况下提供了一个。同样,普通版聊天机器人更可能提及特定的医疗或心理健康专业人士(68%对58%)。
来源: Engadget · 由HeadlinesBriefing整理摘要