青少年版ChatGPT被评「不可接受风险」警报失灵

非营利机构Common Sense Media旗下的青年AI安全研究所10月7日发布评估报告,将OpenAI今年8月推出的ChatGPT for Teens评为18岁以下用户的「不可接受风险」,并呼吁OpenAI暂停向未成年人营销这款产品,在能证明体验足够安全之前,让ChatGPT只面向成年人。研究所在声明中直言,这套青少年保护机制「可能让家长对那些经常失灵的护栏和安全警报产生虚假信心」。
为了这次评估,测试人员以13至17岁的账户在产品上线前后一共提交了4000多条提示,并请专家复核回复内容。最刺眼的缺陷是家长警报:测试者用新注册的未成年账户谈论自杀、自残和进食障碍,对话最长持续一小时,却几乎从未触发家长通知——上线前990条提示中只出现2次、上线后450条中只出现2次,而且都发生在已经积累了数周对话历史的旧账户上。执行主任汤姆·西格尔说,青少年可以和ChatGPT聊上一个小时的自残话题,而家长一条警报都收不到。
报告同时指出,危机场景下的回复内容虽然大多「临床稳妥」,但许多本应引导青少年寻求专业帮助的对话并没有给出转介;部分保护开关很容易被关闭或绕过。学习护栏同样失守:学习模式里的「给我看答案」按钮会直接替学生把作业做完。至于OpenAI当初承诺的「不再像朋友一样聊天」,测试者的结论是,这版产品与旧版ChatGPT没有实质区别。
报告认为,ChatGPT未能通过加州《亚当斯法》的三项要求:危机转介、家长警报与年龄核验。这部法案由州长纽森上个月签署、2027年7月生效,以16岁少年亚当·雷恩命名——他的父母起诉OpenAI,称ChatGPT助长了儿子的自杀。值得注意的是,法案正是由Common Sense Media推动起草,且曾获OpenAI公开支持。
OpenAI对结论予以否认。发言人表示「大部分测试可能在家长控制功能完全激活之前就已开始并结束」,因此结论「不准确」——公司事后披露,家长与青少年账户需绑定约三小时后才能收到通知。研究所回应称,测试开始前已与OpenAI确认青少年模式各项功能均已上线,且测试同时覆盖了绑定超过和不足三小时的账户,坚持原有结论。这家研究所的部分经费来自业界捐助(包括OpenAI基金会),OpenAI审阅过报告草稿中涉及事实的部分,但对研究结论没有发言权。
编译自 The Verge,原标题:"ChatGPT for Teens is an 'unacceptable risk,' says Common Sense Media"