ChatGPT 推出 Trusted Contact 可选安全功能
Introducing Trusted Contact in ChatGPT
OpenAI 开始在 ChatGPT 中推出 Trusted Contact,一项可选安全功能,允许成年人指定信任的人,当自动系统和受训审核人员检测到用户可能讨论严重自伤风险时通知对方。被指定者需在一周内接受邀请才生效;通知仅说明大致原因,不包含聊天记录,每条通知经人工审核后发出,目标在一小时内完成审核。该功能建立在青少年家长控制安全通知之上,与本地化危机热线并行,不替代专业护理或危机服务。
原文说明了功能触发条件、通知内容限制和人工审核时限,读者可以据此了解这项安全机制的实际运作方式。
在 ChatGPT 中推出可信联系人
在最重要的时刻,将你与你信任的人连接起来。
加载中…
分享
人们使用 ChatGPT 来学习、探索想法、解决问题,并反思个人问题。有时这些对话可能会涉及某人正在挣扎或寻求支持的时刻。我们的目标是设计出能够对敏感对话做出深思熟虑回应的系统,并鼓励人们在需要时与现实生活中的人建立联系。
今天,我们开始逐步推出可信联系人,这是 ChatGPT 中的一项可选安全功能,允许成年人在提名一位他们信任的人,例如朋友、家人或照护者;如果我们的自动化系统和经过培训的审核人员检测到已登记用户可能以表明存在严重安全担忧的方式谈论伤害自己,这位联系人可能会收到通知。可信联系人旨在提供另一层支持,与 ChatGPT 中已有的本地求助热线一起,帮助用户在处于危机时联系到他们信任的人。
可信联系人建立在家长控制安全通知(在新窗口中打开)的基础上,后者允许父母或监护人在关联的青少年账户出现严重痛苦迹象时收到提醒。现在,我们正在扩展安全提醒选项,使任何年满 18 岁的人都可以选择添加他们信任的人作为可信联系人。
可信联系人如何运作
专家指导(在新窗口中打开)指出,社会联系是降低自杀风险最重要的保护因素之一。可信联系人(在新窗口中打开)旨在鼓励用户与他们已经信任的人建立联系。它不能替代专业护理或危机服务,并且是支持处于痛苦中的人们的多层保障措施之一。ChatGPT 仍会在适当时候鼓励用户联系危机热线或紧急服务。
“心理科学一再表明,社会联系是一种强大的保护因素,尤其是在情绪痛苦时期。帮助人们提前确定一位可信的人,同时保留他们的选择和自主权,可以让他们在最重要的时刻更容易寻求现实世界中的支持。”
——Arthur Evans 博士,美国心理学会首席执行官
可信联系人遵循以下几个步骤:
用户可以从其 ChatGPT 设置中添加一位成年人(全球 18 岁以上,韩国 19 岁以上)作为其可信联系人。
可信联系人将收到一份说明其角色的邀请,并且必须在一周内接受邀请,该功能才会生效。如果可信联系人拒绝,用户可以选择添加另一位成年人。
如果我们的自动化监测系统检测到用户可能正在以表明存在严重安全担忧的方式谈论自我伤害,ChatGPT 会告知用户我们可能会通知其可信联系人,并鼓励用户联系其可信联系人,同时提供建议的对话开场白。
随后,一个由经过专门培训的人员组成的小团队会审查相关情况。如果这些审核人员确定该对话可能表明存在严重安全担忧,ChatGPT 将通过电子邮件、短信或应用内通知向可信联系人发送简短通知(如果对方拥有 ChatGPT 账户)
该通知有意保持有限的信息量。它会告知一个大致原因,即自残以可能令人担忧的方式出现,并鼓励信任联系人前去关心。为保护用户隐私,通知不包含聊天细节或记录。通知中还包含一个指向专家指导(在新窗口中打开)的链接,用于应对敏感对话。
用户随时可以在设置中移除或编辑其信任联系人,信任联系人也可以随时从我们的帮助中心(在新窗口中打开)中自行移除。

虽然这些严重的安全情况很少发生,但当它们出现时,我们的系统旨在支持及时审查和响应。虽然没有系统是完美的,发给信任联系人的通知也可能并不总能准确反映某人的实际经历,但每一条通知在发送前都会经过训练有素的人员审查,我们力求在一小时内完成对这些安全通知的审查。
在临床医生和安全专家的指导下
我们在临床医生、研究人员以及专注于心理健康和自杀预防的组织的指导下开发了信任联系人功能。这项工作参考了我们的全球医师网络——一个由遍布60个国家的260多名执业医师组成的网络——以及我们的福祉与AI专家委员会。我们还与外部组织密切合作,包括美国心理学会。(在新窗口中打开)
“AI最大的前景之一,是它能够促进真实的人与人之间的联系和心理安全。ChatGPT的信任联系人功能令我感到鼓舞,它朝着赋能人类迈出了一步,尤其是在脆弱的时刻。”
——Munmun De Choudhury博士,佐治亚理工学院J. Z. Liang交互计算教授,福祉与AI专家委员会成员

在每个阶段优先考虑安全
除了信任联系人之外,ChatGPT还设有保障措施,帮助在对话的每个阶段引导敏感话题。我们一直在改进系统对对话中表达的不同风险级别的响应方式:
支持现实世界的帮助:在敏感时刻,ChatGPT可能会鼓励人们联系紧急服务、危机热线、心理健康专业人士或生活中信任的人。
**以关怀回应:**我们与170多位心理健康专家合作,提升ChatGPT检测和回应潜在痛苦迹象、缓和对话,并在适当时引导人们获得现实世界支持的能力。
**帮助人们掌控自己的时间:**在某些情况下,ChatGPT可能会在长时间使用后建议休息或暂时离开,以促进健康的科技使用习惯。
拒绝有害请求:ChatGPT经过训练,会拒绝提供自杀或自残的指导。当用户请求此类信息时,系统会拒绝该请求,转而引导至更安全的回应,并展示本地化的危机资源。

持续推动AI安全的发展
Trusted Contact 是 OpenAI 更广泛努力的一部分,旨在构建能够在困难时刻帮助人们的人工智能系统。 我们将继续与临床医生、研究人员和政策制定者合作,改进人工智能系统在人们可能经历痛苦时的响应方式。我们的目标是确保人工智能系统不是孤立存在的。相反,它们应该帮助人们连接到现实世界中最关心的照护、关系和资源。
作者
OpenAI
来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · openai.com