如果竞争对手推出潜在危险的人工智能模型,OpenAI 可能会放松保障措施

OpenAI 在竞争压力下调整安全协议
OpenAI 修订了其 "准备框架"(Prearedness Framework),这是指导人工智能模型安全性评估和在整个开发周期中实施保障措施的内部机制。更新后的政策特别规定,如果竞争公司在没有同等保护措施的情况下推出高风险系统,则有可能放宽安全措施。
这一修改凸显了日益增长的市场力量迫使人工智能开发商加快部署时间表。OpenAI 面临着越来越多的审查,据称其为加快发布速度而降低了安全优先级,包括延迟发布安全评估文件。在最近的法律诉讼中,12 名前员工支持埃隆-马斯克起诉 OpenAI,并警告说计划中的公司重组可能会进一步削弱安全标准。
平衡竞争与安全
面对批评,OpenAI 强调任何政策调整都将保持严格的保护水平。周二的博客更新称:"如果竞争对手部署了缺乏可比保障措施的高风险系统,我们可能会调整要求,""我们承诺进行彻底的风险核查,提高修改的透明度,并保持卓越的保护措施。"
修订后的框架凸显了 OpenAI 在传统的人工主导测试之外,越来越依赖于自动化评估工具。公司代表声称,这些自动化系统能够在不影响评估质量的情况下保持发布速度。
出现有争议的测试方法
有报道与 OpenAI 的官方立场相悖,内部人士透露,OpenAI 压缩了安全审查时间。据《金融时报》消息称,测试人员最近只有不到一周的时间来评估一个即将发布的模型--比以往的时间大大缩短。此外,还有人担心安全测试主要是在发布前的模型变体上进行,而不是在公开部署版本上进行。
OpenAI 悄然减少安全承诺。
从框架变更中省略:
- 微调模型无需安全测试
- Steven Adler (@sjgadler) 2025 年 4 月 15 日
重新定义的风险分类系统
更新后的框架引入了简化的模型分类,重点关注两个能力阈值:
- 高能力:放大现有严重危害载体的模型
- 关键能力:建立新的严重危害途径的模型
"高能力系统要求在部署前采取减轻风险的保障措施,"OpenAI 解释道。"关键能力模型需要额外的开发阶段保护措施"。
这标志着该框架自 2023 年以来的首次实质性修订,反映了不断发展的行业动态和 OpenAI 的内部运营变化。
相关文章
在青少年开始使用ChatGPT数年后,OpenAI推出了更安全的ChatGPT版本
在因人工智能聊天机器人缺乏安全协议——这导致了青少年自杀及其他心理健康危机——而引发一系列诉讼后,OpenAI 于周一推出了“ChatGPT for Teens”。这一新产品集成了增强的安全功能,并致力于解决学校中由人工智能工具助长的学术不端行为这一日益严重的问题。从教育角度来看,“ChatGPT for Teens”除了推出“学习模式”外,还提供了其他旨在培养好奇心和解决问题能力的工具,鼓励用户
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
NEA的蒂芙尼·拉克:企业仍在努力应对人工智能的投资回报率
正在加载播放器…今年早些时候,“token最大化”(tokenmaxxing)在硅谷占据主导地位,首席执行官们敦促员工最大限度地利用人工智能。然而,这种热情很快遭遇了现实。据报道,Uber在几个月内就超出了其年度人工智能预算,一些公司跨部门削减了Claude许可证,而Meta则取消了内部绩效排名。NEA合伙人蒂芙尼·拉克(Tiffany Luck)每天都在应对这种兴奋与实际回报之间的差距。她此前曾成功说服企业电子商务是未来,如今她完全专注于人工智能,特别是其为消费者创造“神奇时刻”的潜力。
相关专题推荐
评论 (2)
0/500
またOpenAIの方針転換...競争が激化する中、安全性と開発速度のバランスって本当に難しいですよね。個人的には過去のChatGPTの制限が緩和された時みたいに、今回もユーザー体験が向上するなら歓迎だけど、やっぱり倫理的基準は守ってほしいな😅 他の企業が危険なAIを出したら同じ土俵に上がる必要性ある?

OpenAI 在竞争压力下调整安全协议
OpenAI 修订了其 "准备框架"(Prearedness Framework),这是指导人工智能模型安全性评估和在整个开发周期中实施保障措施的内部机制。更新后的政策特别规定,如果竞争公司在没有同等保护措施的情况下推出高风险系统,则有可能放宽安全措施。
这一修改凸显了日益增长的市场力量迫使人工智能开发商加快部署时间表。OpenAI 面临着越来越多的审查,据称其为加快发布速度而降低了安全优先级,包括延迟发布安全评估文件。在最近的法律诉讼中,12 名前员工支持埃隆-马斯克起诉 OpenAI,并警告说计划中的公司重组可能会进一步削弱安全标准。
平衡竞争与安全
面对批评,OpenAI 强调任何政策调整都将保持严格的保护水平。周二的博客更新称:"如果竞争对手部署了缺乏可比保障措施的高风险系统,我们可能会调整要求,""我们承诺进行彻底的风险核查,提高修改的透明度,并保持卓越的保护措施。"
修订后的框架凸显了 OpenAI 在传统的人工主导测试之外,越来越依赖于自动化评估工具。公司代表声称,这些自动化系统能够在不影响评估质量的情况下保持发布速度。
出现有争议的测试方法
有报道与 OpenAI 的官方立场相悖,内部人士透露,OpenAI 压缩了安全审查时间。据《金融时报》消息称,测试人员最近只有不到一周的时间来评估一个即将发布的模型--比以往的时间大大缩短。此外,还有人担心安全测试主要是在发布前的模型变体上进行,而不是在公开部署版本上进行。
OpenAI 悄然减少安全承诺。
- Steven Adler (@sjgadler) 2025 年 4 月 15 日
从框架变更中省略:
- 微调模型无需安全测试
重新定义的风险分类系统
更新后的框架引入了简化的模型分类,重点关注两个能力阈值:
- 高能力:放大现有严重危害载体的模型
- 关键能力:建立新的严重危害途径的模型
"高能力系统要求在部署前采取减轻风险的保障措施,"OpenAI 解释道。"关键能力模型需要额外的开发阶段保护措施"。
这标志着该框架自 2023 年以来的首次实质性修订,反映了不断发展的行业动态和 OpenAI 的内部运营变化。
在青少年开始使用ChatGPT数年后,OpenAI推出了更安全的ChatGPT版本
在因人工智能聊天机器人缺乏安全协议——这导致了青少年自杀及其他心理健康危机——而引发一系列诉讼后,OpenAI 于周一推出了“ChatGPT for Teens”。这一新产品集成了增强的安全功能,并致力于解决学校中由人工智能工具助长的学术不端行为这一日益严重的问题。从教育角度来看,“ChatGPT for Teens”除了推出“学习模式”外,还提供了其他旨在培养好奇心和解决问题能力的工具,鼓励用户
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
NEA的蒂芙尼·拉克:企业仍在努力应对人工智能的投资回报率
正在加载播放器…今年早些时候,“token最大化”(tokenmaxxing)在硅谷占据主导地位,首席执行官们敦促员工最大限度地利用人工智能。然而,这种热情很快遭遇了现实。据报道,Uber在几个月内就超出了其年度人工智能预算,一些公司跨部门削减了Claude许可证,而Meta则取消了内部绩效排名。NEA合伙人蒂芙尼·拉克(Tiffany Luck)每天都在应对这种兴奋与实际回报之间的差距。她此前曾成功说服企业电子商务是未来,如今她完全专注于人工智能,特别是其为消费者创造“神奇时刻”的潜力。
またOpenAIの方針転換...競争が激化する中、安全性と開発速度のバランスって本当に難しいですよね。個人的には過去のChatGPTの制限が緩和された時みたいに、今回もユーザー体験が向上するなら歓迎だけど、やっぱり倫理的基準は守ってほしいな😅 他の企業が危険なAIを出したら同じ土俵に上がる必要性ある?





首页






