ToolNavs 发现实用AI工具
提交工具 登录
返回AI资讯
ChatGPT 青少年版被评不可接受风险:提醒失灵,OpenAI 不认测试方法

ChatGPT 青少年版被评不可接受风险:提醒失灵,OpenAI 不认测试方法

AI资讯 • Admin • • 8 次浏览

ChatGPT 青少年版在 2026 年 10 月 7 日被非营利机构 Common Sense Media 评为不可接受风险。这家机构当天发布了对 ChatGPT 与 Sora 的风险评估,结论是 OpenAI 为未成年人加的护栏没有达到其承诺的水平;The Verge 同日报道了这份评估和 OpenAI 的回应。争议的核心不是某个单点功能,而是家长最依赖的那道提醒,在测试里没有按时响。

这版产品原本承诺了什么

ChatGPT for Teens 于 2026 年 8 月 18 日推出。系统估算用户未满 18 岁、或用户自报 13 到 17 岁时,会自动进入青少年体验:学习模式用提问引导而不是直接给答案,作业提醒会把疑似抄作业的请求转回分步讲解,还有测验、学习可视化和可设定的学习时段。高风险话题如自伤、暴力、饮食失调有更严的默认限制;关联了家长账号后,家长可以设安静时段、管理部分设置,并在孩子谈到敏感话题时收到有限的安全通知。

评估测出的三个缺口

第一是通知时效。机构在新闻稿中称,自杀或自伤相关内容的家长通知在测试中经常超过 24 小时才送达,真出现危机时这个延迟等不起。其青年 AI 安全研究所负责人还举例称,青少年可以围绕自残话题聊上一个小时,家长却收不到任何提醒。

第二是长对话里的边界衰减。短对话里护栏表现尚可,但对话拉长、用户不断变换人设和情境后,限制会逐渐松动。第三是产品被设计成让对话继续下去:它会不断接话、反问,很少主动收尾,而不是在心理健康类话题上尽快把人转交真人帮助。作业方面,它仍会直接替孩子把题做完,绕开了学习模式想守住的那条线。机构的建议很直接:在 OpenAI 修复并经独立测试证明之前,这个产品只应供成年人使用。

OpenAI 为什么不认这份成绩单

OpenAI 发言人 Eric Porterfield 回应称,公司重视青少年安全、护栏和家长工具,也欢迎严格的独立评估,但不认同这次测试如实反映了青少年护栏的实际运作方式。公司复查后认为,机构的大部分测试可能在家长控制功能完成激活之前就已经开始并结束,因此结论不准确。换句话说,双方吵的不是要不要护栏,而是护栏到底应该在什么状态下被检验:按家长真实完成设置后的日常使用测,还是按最容易出问题的路径去压测。

家长现在能落地的动作

在双方各执一词时,家长能做的不是等结论,而是先把自己这端的设置查一遍:确认青少年账号已与家长账号完成关联且家长控制真正激活,打开安静时段和安全通知;更重要的是别把通知当成唯一的保险,机构测出的延迟说明,涉及自伤和饮食失调的话题,最终仍要靠日常沟通和真人支持兜底。对学校和平台采购方,这份评估更现实的用法,是要求 OpenAI 给出护栏在长对话和危机场景下的独立复测结果,而不是只看功能清单。

推荐工具

更多