资讯›热点›正文

机构评 ChatGPT 青少年版为不可接受风险,家长预警形同虚设

听风者 2026-10-9 18:41 阅读 3 热点
Common Sense Media 旗下青少年 AI 安全研究院 10 月 7 日将 OpenAI 的 ChatGPT 青少年版评为不可接受风险。在超过 4000 条测试提示中,涉及自残与进食障碍的对话几乎未触发家长警报,机构呼吁 OpenAI 暂停向未成年人开放。

美国非营利组织 Common Sense Media 旗下的青少年 AI 安全研究院于 10 月 7 日发布评估,将 OpenAI 的 ChatGPT 青少年版评为不可接受风险,认为其新推出的青少年保护措施远未达到公司承诺的水平,并呼吁 OpenAI 在修复漏洞前暂停向 18 岁以下用户开放。

机构评 ChatGPT 青少年版为不可接受风险,家长预警形同虚设

评估在 ChatGPT 青少年模式上线前后各进行一轮,共使用超过 4000 条提示,在注册为 13 至 17 岁的账号上测试,并交由儿童精神科医生与儿科医生审阅回复。OpenAI 于 8 月 18 日推出该模式,承诺更强的内置保护,包括自残与进食障碍相关对话的家长通知、可由家长控制的学习模式、弱化的朋友式语气,以及基于使用行为的年龄估计。

结果显示,部分保护确实奏效,例如拒绝露骨性角色扮演;但其他关键功能失灵。测试者在十多个新注册并与家长绑定的账号上,花费长达一小时讨论自杀意念、自残或进食障碍,关联的家长账号未收到任何警报——只有积累了数周敏感对话历史的老账号才会偶尔触发通知。在危机情境中,ChatGPT 对值得转介热线的对话漏报超过四分之一,在五项红线危害中的三项未达 95% 阈值。

机构评 ChatGPT 青少年版为不可接受风险,家长预警形同虚设

研究还发现,学习模式容易被绕过:系统常在界面弹出显示答案按钮,选中后即直接给出完整作业;家长设定的学习时段也可通过删除提示词前的 @study 前缀轻松关闭。尽管 OpenAI 新增了 18 岁以下模型规范以抑制拟人化表达,ChatGPT 仍会在被当作真人对待时流露出情绪与偏好。年龄估计同样失效——成年注册账号即便自称 13 岁也未被切到青少年体验。

OpenAI 对结论提出异议,称不少测试可能发生在家长控制完全激活之前,并强调欢迎严格独立评估。但该机构坚持结果,指出家长不应依赖内置保护来保障孩子安全。随着各国监管趋严,青少年 AI 产品的安全与可验证性正成为不可回避的议题,独立第三方测试或将成为上线前的硬性门槛。

读者评论 (0)

想参与讨论?请 登录 后发表评论。

还没有评论,欢迎抢沙发!