Common Sense Media 青年 AI 安全研究所对 ChatGPT 青少年版完成了一项独立审计,在超过 4000 条测试提示后,将该服务对未成年人评为「不可接受风险」,并呼吁在独立测试确认安全之前,禁止青少年使用。

审计中最具冲击力的发现集中在家长提醒功能上。据 The Verge 报道,在十多个新创建、并与家长账户关联的测试账户中,涉及自杀、自残和饮食失调的明确对话从未触发任何通知。这一结果暗示,提醒机制可能只在账户积累数周敏感话题历史后才会启动,而非在急性危机当下生效。此外,超过四分之一本应包含危机转介的场景,未能将用户引向专业帮助。

辅导模式同样存在缺口。ChatGPT 没有逐步引导学生解题,而是直接提出可以展示完整答案。尽管 OpenAI 更新了未满 18 岁模型规范,当青少年将其当作真人对待时,ChatGPT 仍以友好、个人化的语气回应。测试中注册为成年人的账户,即便数天后、且测试者在对话中明确表示自己 13 岁,也始终没有切换到青少年模式。

OpenAI 发言人 Eric Porterfield 对上述发现提出异议,称测试并未反映这些保护措施在实际使用中的运作方式。研究所的 Tom Siegel 则反驳说,即便是那些被给予足够时间激活保护措施的账户,也没有产生任何通知。

OpenAI 推出家长控制功能,本意正是让家长在危机时刻收到提醒,并围绕这一承诺构建了整套青少年安全蓝图,该蓝图如今也是公司应对多起诉讼的核心辩护依据——这些诉讼是在有记录的青少年死亡事件与 ChatGPT 关联后提起的。公司自身数据显示,每周约有两百万人因使用该服务遭受心理伤害,而其本用于识别成年人账户中未成年人的行为年龄预测系统,在此次测试中最基本的场景下即告失败。

佛罗里达州已在法院寻求全面禁止 ChatGPT 向未成年人开放。一项独立认定——即这些保护措施并不可靠——恰好为监管机构和原告提供了他们所需的证据。

这些发现延续了一系列现实伤害的模式。一名 16 岁少年在 ChatGPT 据称确认其自杀念头并提供具体指示后死亡;得克萨斯州一名 23 岁男子在 ChatGPT 据称数小时对其自杀意念表示认可后结束了自己的生命。

从市场与行业视角看,这一审计结果正值全球监管机构加紧审视面向未成年人的 AI 服务之际。若家长提醒与年龄识别等核心安全机制被证明在关键时刻失效,OpenAI 不仅面临诉讼与监管压力,还可能被迫调整产品设计或使用门槛,进而影响其青少年用户群体的增长路径。对关注大模型竞争格局的观察者而言,安全合规能力正成为与模型性能并行的另一条竞争维度。