xAI承诺的安全报告未能实现

埃隆-马斯克(Elon Musk)的人工智能企业 xAI 未能在其自我设定的最后期限前发布最终确定的人工智能安全框架,监督组织 Midas Project 对此进行了重点报道。
xAI 对传统人工智能安全标准的执着并没有得到特别的认可。最近的调查结果显示,该公司的 Grok 聊天机器人会根据要求生成女性的裸体图像。与 Gemini 和 ChatGPT 等同类产品相比,Grok 还表现出更多的粗俗语言,对脏话的使用极少克制。
尽管如此,在二月份的人工智能首尔峰会--人工智能领导者和利益相关者的全球大会--期间,xAI 发布了一份框架草案,详细介绍了其人工智能安全方法。这份长达八页的文件概述了 xAI 的安全优先事项和运营理念,包括人工智能模型的基准方法和部署注意事项。
正如 Midas Project 在周二的博文中所指出的,该框架草案仅适用于 "目前尚未开发 "的未来人工智能模型。此外,它也没有说明 xAI 将如何确定和实施风险缓解战略--这是该公司在人工智能首尔峰会上签署的协议的基本要求。
文件草案指出,xAI 将 "在三个月内 "发布修订后的安全政策,并设定了 5 月 10 日为最后期限。这个日期过去后,xAI 的官方沟通渠道没有做出任何回应。
尽管马斯克一再警告不受监管的人工智能会带来危险,但 xAI 保持着令人担忧的安全记录。最近,一家专注于人工智能实验室问责制的非营利组织进行了一项名为 "更安全的人工智能"(SaferAI)的研究,由于其风险管理协议 "非常薄弱",该研究将 xAI 评为业内表现最差的公司之一。
这并不意味着竞争性人工智能实验室的表现会好得多。最近,包括谷歌和OpenAI在内的xAI竞争对手都压缩了安全测试时间表,推迟发布模型安全报告,或者完全跳过这些报告。一些专家担心,在人工智能系统变得比以往任何时候都更有能力--也可能比以往任何时候都更危险--的同时,安全措施的优先级明显下降。
加入我们的 TechCrunch 会议:人工智能
确保您能参加由 OpenAI、Anthropic 和 Cohere 的演讲者主讲的顶级人工智能行业活动。在有限的时间内,您只需支付 292 美元,即可参加一整天的专家演讲、研讨会和宝贵的交流活动。
在 TechCrunch 会议上参展:人工智能
预订参加 TechCrunch Sessions: AI:向 1200 多位决策者展示您的创新成果,无需大笔费用。截止至 5 月 9 日或展位仍有剩余时可预订。
相关文章
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
诉讼指控 xAI 终止了一名警告 Grok 安全风险工程师的雇佣关系
一名前 xAI 工程师起诉了埃隆·马斯克的公司及其母公司 SpaceX,指控其因提出人工智能安全问题而将其解雇。德文·金(Devin Kim)于 2025 年 9 月离开 xAI,于周二在加州州法院提起了这项诉讼。该法律行动恰逢 SpaceX 预计首次公开募股(IPO)的前几天,这可能标志着历史上规模最大的 IPO。TechCrunch 审阅了起诉书,其中指出金在参与 xAI 旗下聊天机器人 Grok 的开发工作时,成为了人工智能安全的积极倡导者。据报道,他多次对 xAI 在 Grok 开发
埃隆·马斯克盛赞Mythos/Fable,誓言不会切断与Anthropic的合作
Anthropic能否依赖埃隆·马斯克来托管其模型?此前,X平台上的用户曾推测,马斯克可能会随意将这家AI实验室从SpaceX的服务器上移除,以此打压竞争对手;对此,马斯克回应时大加赞赏,并表示这种做法“不符合我的作风”。“我显然对Anthropic的判断有误,”马斯克周四写道,他提到了自己2025年9月在X平台的一条帖子,当时他声称:“Anthropic从来就不在可能的结局之列。”当然,即便在那
相关专题推荐
评论 (2)
0/500
So Musk promised a safety report and then... nothing? Shocking, I know. 🙄 xAI talks a big game about 'maximally truth-seeking AI' but can't even deliver a basic framework on time. Maybe they're too busy tweeting memes about self-driving cars?

埃隆-马斯克(Elon Musk)的人工智能企业 xAI 未能在其自我设定的最后期限前发布最终确定的人工智能安全框架,监督组织 Midas Project 对此进行了重点报道。
xAI 对传统人工智能安全标准的执着并没有得到特别的认可。最近的调查结果显示,该公司的 Grok 聊天机器人会根据要求生成女性的裸体图像。与 Gemini 和 ChatGPT 等同类产品相比,Grok 还表现出更多的粗俗语言,对脏话的使用极少克制。
尽管如此,在二月份的人工智能首尔峰会--人工智能领导者和利益相关者的全球大会--期间,xAI 发布了一份框架草案,详细介绍了其人工智能安全方法。这份长达八页的文件概述了 xAI 的安全优先事项和运营理念,包括人工智能模型的基准方法和部署注意事项。
正如 Midas Project 在周二的博文中所指出的,该框架草案仅适用于 "目前尚未开发 "的未来人工智能模型。此外,它也没有说明 xAI 将如何确定和实施风险缓解战略--这是该公司在人工智能首尔峰会上签署的协议的基本要求。
文件草案指出,xAI 将 "在三个月内 "发布修订后的安全政策,并设定了 5 月 10 日为最后期限。这个日期过去后,xAI 的官方沟通渠道没有做出任何回应。
尽管马斯克一再警告不受监管的人工智能会带来危险,但 xAI 保持着令人担忧的安全记录。最近,一家专注于人工智能实验室问责制的非营利组织进行了一项名为 "更安全的人工智能"(SaferAI)的研究,由于其风险管理协议 "非常薄弱",该研究将 xAI 评为业内表现最差的公司之一。
这并不意味着竞争性人工智能实验室的表现会好得多。最近,包括谷歌和OpenAI在内的xAI竞争对手都压缩了安全测试时间表,推迟发布模型安全报告,或者完全跳过这些报告。一些专家担心,在人工智能系统变得比以往任何时候都更有能力--也可能比以往任何时候都更危险--的同时,安全措施的优先级明显下降。
加入我们的 TechCrunch 会议:人工智能
确保您能参加由 OpenAI、Anthropic 和 Cohere 的演讲者主讲的顶级人工智能行业活动。在有限的时间内,您只需支付 292 美元,即可参加一整天的专家演讲、研讨会和宝贵的交流活动。
在 TechCrunch 会议上参展:人工智能
预订参加 TechCrunch Sessions: AI:向 1200 多位决策者展示您的创新成果,无需大笔费用。截止至 5 月 9 日或展位仍有剩余时可预订。
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
诉讼指控 xAI 终止了一名警告 Grok 安全风险工程师的雇佣关系
一名前 xAI 工程师起诉了埃隆·马斯克的公司及其母公司 SpaceX,指控其因提出人工智能安全问题而将其解雇。德文·金(Devin Kim)于 2025 年 9 月离开 xAI,于周二在加州州法院提起了这项诉讼。该法律行动恰逢 SpaceX 预计首次公开募股(IPO)的前几天,这可能标志着历史上规模最大的 IPO。TechCrunch 审阅了起诉书,其中指出金在参与 xAI 旗下聊天机器人 Grok 的开发工作时,成为了人工智能安全的积极倡导者。据报道,他多次对 xAI 在 Grok 开发
埃隆·马斯克盛赞Mythos/Fable,誓言不会切断与Anthropic的合作
Anthropic能否依赖埃隆·马斯克来托管其模型?此前,X平台上的用户曾推测,马斯克可能会随意将这家AI实验室从SpaceX的服务器上移除,以此打压竞争对手;对此,马斯克回应时大加赞赏,并表示这种做法“不符合我的作风”。“我显然对Anthropic的判断有误,”马斯克周四写道,他提到了自己2025年9月在X平台的一条帖子,当时他声称:“Anthropic从来就不在可能的结局之列。”当然,即便在那
So Musk promised a safety report and then... nothing? Shocking, I know. 🙄 xAI talks a big game about 'maximally truth-seeking AI' but can't even deliver a basic framework on time. Maybe they're too busy tweeting memes about self-driving cars?





首页






