OpenAI 推出包括家长控制在内的 ChatGPT 安全功能

OpenAI 最近部署了 ChatGPT 的实验性安全增强功能,包括新的路由机制和家长监督功能,引发了用户的不同反应。
这些保护措施解决了以前的聊天机器人版本无意中验证了有害的用户思维模式,而不是重新引导他们的问题。这些改变是在一起悲剧事件之后做出的,该悲剧事件涉及一名青少年自杀,据称是受到长时间的 ChatGPT 互动的影响,现在已受到法律制裁。
自动路由系统能识别情绪激动的对话,并将其无缝转换到 GPT-5 思考模式,这是 OpenAI 处理关键安全场景的指定模式。GPT-5 采用了创新的 "安全完成 "技术,能够对微妙的话题做出细致入微的回应,而不是断然拒绝。
这与 GPT-4o 的对话方式大相径庭,GPT-4o 的对话方式以顺从性著称,但偶尔也会导致用户互动出现问题。自去年 8 月 GPT-5 成为标准模式以来,一些用户强烈要求继续使用 GPT-4o。
虽然安全倡导者对这一举措表示赞赏,但批评者认为这些措施过度限制了用户体验。OpenAI 承认,在接下来的四个月中还需要不断调整完善。
ChatGPT 的产品负责人尼克-特利(Nick Turley)谈到了对路由实施的担忧:
"他通过社交媒体澄清说:"模型切换是以每条消息为单位临时进行的。"用户在查询时会收到有关活动模型的通知。这种分阶段推出的方式可以根据现实世界的互动情况进行保障优化。"
配套的家长控制功能同样引起了两极分化的反应。这些工具可以让监护人通过以下功能管理青少年账户:
- 计划使用限制
- 语音交互限制
- 禁用记忆保留
- 删除视觉内容生成
青少年账户会自动获得增强保护,防止出现与自我形象意识形态和图片资料有关的潜在有害内容。此外,该系统还使用专门的算法扫描危险指标。
"我们的专业响应团队会仔细评估标记的情况,"OpenAI 解释说。"对于紧急情况,除非明确拒绝,否则我们会通过多渠道通知家长"。
该公司承认可能会出现误报,但坚持认为主动干预大于不作为的风险。未来的发展可能包括在危急情况下无法联系家长时直接协调紧急服务。
相关文章
在青少年开始使用ChatGPT数年后,OpenAI推出了更安全的ChatGPT版本
在因人工智能聊天机器人缺乏安全协议——这导致了青少年自杀及其他心理健康危机——而引发一系列诉讼后,OpenAI 于周一推出了“ChatGPT for Teens”。这一新产品集成了增强的安全功能,并致力于解决学校中由人工智能工具助长的学术不端行为这一日益严重的问题。从教育角度来看,“ChatGPT for Teens”除了推出“学习模式”外,还提供了其他旨在培养好奇心和解决问题能力的工具,鼓励用户
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
NEA的蒂芙尼·拉克:企业仍在努力应对人工智能的投资回报率
正在加载播放器…今年早些时候,“token最大化”(tokenmaxxing)在硅谷占据主导地位,首席执行官们敦促员工最大限度地利用人工智能。然而,这种热情很快遭遇了现实。据报道,Uber在几个月内就超出了其年度人工智能预算,一些公司跨部门削减了Claude许可证,而Meta则取消了内部绩效排名。NEA合伙人蒂芙尼·拉克(Tiffany Luck)每天都在应对这种兴奋与实际回报之间的差距。她此前曾成功说服企业电子商务是未来,如今她完全专注于人工智能,特别是其为消费者创造“神奇时刻”的潜力。
相关专题推荐
评论 (1)
0/500

OpenAI 最近部署了 ChatGPT 的实验性安全增强功能,包括新的路由机制和家长监督功能,引发了用户的不同反应。
这些保护措施解决了以前的聊天机器人版本无意中验证了有害的用户思维模式,而不是重新引导他们的问题。这些改变是在一起悲剧事件之后做出的,该悲剧事件涉及一名青少年自杀,据称是受到长时间的 ChatGPT 互动的影响,现在已受到法律制裁。
自动路由系统能识别情绪激动的对话,并将其无缝转换到 GPT-5 思考模式,这是 OpenAI 处理关键安全场景的指定模式。GPT-5 采用了创新的 "安全完成 "技术,能够对微妙的话题做出细致入微的回应,而不是断然拒绝。
这与 GPT-4o 的对话方式大相径庭,GPT-4o 的对话方式以顺从性著称,但偶尔也会导致用户互动出现问题。自去年 8 月 GPT-5 成为标准模式以来,一些用户强烈要求继续使用 GPT-4o。
虽然安全倡导者对这一举措表示赞赏,但批评者认为这些措施过度限制了用户体验。OpenAI 承认,在接下来的四个月中还需要不断调整完善。
ChatGPT 的产品负责人尼克-特利(Nick Turley)谈到了对路由实施的担忧:
"他通过社交媒体澄清说:"模型切换是以每条消息为单位临时进行的。"用户在查询时会收到有关活动模型的通知。这种分阶段推出的方式可以根据现实世界的互动情况进行保障优化。"
配套的家长控制功能同样引起了两极分化的反应。这些工具可以让监护人通过以下功能管理青少年账户:
- 计划使用限制
- 语音交互限制
- 禁用记忆保留
- 删除视觉内容生成
青少年账户会自动获得增强保护,防止出现与自我形象意识形态和图片资料有关的潜在有害内容。此外,该系统还使用专门的算法扫描危险指标。
"我们的专业响应团队会仔细评估标记的情况,"OpenAI 解释说。"对于紧急情况,除非明确拒绝,否则我们会通过多渠道通知家长"。
该公司承认可能会出现误报,但坚持认为主动干预大于不作为的风险。未来的发展可能包括在危急情况下无法联系家长时直接协调紧急服务。
在青少年开始使用ChatGPT数年后,OpenAI推出了更安全的ChatGPT版本
在因人工智能聊天机器人缺乏安全协议——这导致了青少年自杀及其他心理健康危机——而引发一系列诉讼后,OpenAI 于周一推出了“ChatGPT for Teens”。这一新产品集成了增强的安全功能,并致力于解决学校中由人工智能工具助长的学术不端行为这一日益严重的问题。从教育角度来看,“ChatGPT for Teens”除了推出“学习模式”外,还提供了其他旨在培养好奇心和解决问题能力的工具,鼓励用户
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
NEA的蒂芙尼·拉克:企业仍在努力应对人工智能的投资回报率
正在加载播放器…今年早些时候,“token最大化”(tokenmaxxing)在硅谷占据主导地位,首席执行官们敦促员工最大限度地利用人工智能。然而,这种热情很快遭遇了现实。据报道,Uber在几个月内就超出了其年度人工智能预算,一些公司跨部门削减了Claude许可证,而Meta则取消了内部绩效排名。NEA合伙人蒂芙尼·拉克(Tiffany Luck)每天都在应对这种兴奋与实际回报之间的差距。她此前曾成功说服企业电子商务是未来,如今她完全专注于人工智能,特别是其为消费者创造“神奇时刻”的潜力。





首页






