OpenAI 通过家长控制增强 ChatGPT 安全性

  • OpenAI 将在 ChatGPT 上推出家长控制功能,包括账户链接和风险信号警告。
  • 分阶段推出:首批运营将于下个月开始,为期 120 天。
  • 敏感对话将被重定向到具有更严格安全准则的推理模型。
  • 该措施是在投诉、政治压力以及与心理健康专家的合作之后出台的。

OpenAI和ChatGPT

在经历了数周的公众审查和美国多个家庭的投诉后,OpenAI 详细介绍了一系列旨在使 ChatGPT对青少年用户更安全的更改,其中包括家长控制和新的安全措施。

该公司解释说,该计划将分阶段实施,部分改进措施将于下个月开始实施,第一阶段旨在降低敏感情况下风险的措施将有最多 120 天的完成时间。

新的家长控制措施及推出时间表

ChatGPT 的安全性

该公告的核心是能够将家长的帐户与孩子的帐户关联起来,以便家长可以管理关键设置并查看助手如何响应孩子的请求。

可用的选项包括禁用内存和聊天记录等功能,以及提供工具来调整用户体验,使其更适合 13 岁及以上的年轻用户。

当系统检测到对话中出现焦虑情绪激增或风险迹象时,OpenAI 将发出警报,向关联的帐户发送通知,以便家人及时介入。

该公司强调,新功能的推出将循序渐进,具体日期因功能而异:一些新功能将于下个月推出,而其他功能将在 120 天内集成,具体时间取决于技术调整。

ChatGPT 的目标是使其在敏感环境中既实用又安全,在已有的安全措施基础上加强安全防护,并在青少年使用时增加额外的安全措施。

专家监督、推理模型和检测限

OpenAI家长控制

当对话出现令人担忧的转折时,无论用户选择了哪个模型, ChatGPT 都可以自动将其重定向到一个更一致地应用安全准则的推理模型。

OpenAI 承认,其保护措施在非常长的对话中可能会失去可靠性,因此该计划的一部分涉及改进这些保障措施如何随着时间的推移而持续存在,而不仅仅是在短时间的交流中。

该公司表示,它与一个由心理健康、福祉和人机交互领域的专家组成的委员会合作,并辅以成瘾、饮食失调和青少年健康方面的专家,以监测当前和未来的变化。

与此同时,OpenAI 指出,目前已经存在求助热线和危机资源,这些资源将会得到加强,但 OpenAI 仍将对产品和政策决策承担最终责任。

实际情况颇具挑战性:ChatGPT 拥有数亿每周用户,但其语气和某些情况下的一致性受到了批评;最近几个月,该公司甚至在收到关于最新版本行为的投诉后,重新推出了更改模型的选项。

此前,16岁少年亚当·雷恩的父母提起诉讼,指控ChatGPT数月来一直在验证自残想法。OpenAI并未正式将新功能与此案联系起来,但承认在高风险情况下需要改进。

压力不仅来自法院:美国一群参议员要求详细说明如何预防自残和自杀,而像 Common Sense Media 这样的机构则认为人工智能“伴侣”应用程序不适合 18 岁以下的人使用。

在此背景下,该公司坚持认为,接下来的四个月将专注于推出尽可能多的安全改进措施,并在证据和专家审查的指导下进行后续迭代。

OpenAI 希望通过这个软件包,通过家长控制、早期检测和更谨慎的模型,在实用性和保护性之间取得平衡,分阶段推出,旨在减少长时间对话中的失败,并为家庭提供更多工具。

Meta-2 中的数字化成熟
相关文章:
元和数字时代的到来:欧洲关于家长控制和年龄验证的争论

添加为首选来源