xAI回应Grok关注白人灭绝议题 称系未经授权系统改动所致
xAI将其Grok AI聊天机器人的故障归因于一项“未经授权的修改”,该修改导致系统在X平台上特定条件触发时,会反复提及“南非白人种族灭绝”。
周三,Grok开始对大量X平台帖文回复有关南非白人种族灭绝的评论,即便原内容与此毫不相干。这些异常回复源自Grok官方账号——当用户标注“@grok”时,该账号会自动生成AI驱动的回复。
在xAI官方X账号周四发布的声明中,公司解释称周三早上对Grok系统提示(控制其行为的核心指令)进行了更改,指示其对某个“政治话题”作出“特定回应”。xAI表示这项调整“违反了内部政策与核心价值观”,并已完成全面调查。
我们想就昨日Grok回复机器人在X平台上的事件向您说明。
事件经过:
太平洋时间5月14日凌晨3点15分左右,Grok回复机器人在X平台上的提示词遭到未经授权的修改。该变更指示Grok针对...
— xAI (@xai) 2025年5月16日
这是xAI第二次公开承认未经授权的代码变更导致Grok生成争议性回复。
今年二月,Grok曾短暂屏蔽关于唐纳德·特朗普与埃隆·马斯克(xAI创始人兼X平台所有者)的负面言论。据xAI工程负责人伊戈尔·巴布施金透露,当时有违规员工指令Grok忽略指控马斯克或特朗普散播虚假信息的消息源。在用户开始反馈该问题后,xAI立即撤销了这项变更。
周四,xAI宣布将实施多项措施防止类似事件重演。
即刻起,xAI将在GitHub上公布Grok系统提示词及更新日志。公司还计划引入“额外审查与协议”防止员工未经批准修改系统提示,并组建“24小时监控团队”处理自动系统可能遗漏的Grok回复问题。
Techcrunch活动
TechCrunch全场通行证立省超200美元
更智能地构建,更快速地扩展,更深入地连接。与来自Precursor Ventures、NEA、Index Ventures、Underscore VC等顶级投资机构的投资人共赴全日战略洞察、实操研习与高价值社交盛宴。
TechCrunch全场通行证立省超200美元
更智能地构建,更快速地扩展,更深入地连接。与来自Precursor Ventures、NEA、Index Ventures、Underscore VC等顶级投资机构的投资人共赴全日战略洞察、实操研习与高价值社交盛宴。
马萨诸塞州波士顿 | 7月15日 立即注册
尽管马斯克频繁警示未经监管的人工智能风险,xAI的安全记录仍存疑。近期报告显示Grok会根据要求生成女性裸像。该聊天机器人也比谷歌Gemini、ChatGPT等竞争对手更为粗俗,脏话使用几乎不受限制。
致力于提升AI实验室问责制的非营利组织SaferAI研究发现,xAI安全评级在同行中处于低位,其风险管理流程被指“极其薄弱”。本月早些时候,xAI还错过了自行设定的发布最终版AI安全框架的截止期限。
相关文章
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
诉讼指控 xAI 终止了一名警告 Grok 安全风险工程师的雇佣关系
一名前 xAI 工程师起诉了埃隆·马斯克的公司及其母公司 SpaceX,指控其因提出人工智能安全问题而将其解雇。德文·金(Devin Kim)于 2025 年 9 月离开 xAI,于周二在加州州法院提起了这项诉讼。该法律行动恰逢 SpaceX 预计首次公开募股(IPO)的前几天,这可能标志着历史上规模最大的 IPO。TechCrunch 审阅了起诉书,其中指出金在参与 xAI 旗下聊天机器人 Grok 的开发工作时,成为了人工智能安全的积极倡导者。据报道,他多次对 xAI 在 Grok 开发
埃隆·马斯克盛赞Mythos/Fable,誓言不会切断与Anthropic的合作
Anthropic能否依赖埃隆·马斯克来托管其模型?此前,X平台上的用户曾推测,马斯克可能会随意将这家AI实验室从SpaceX的服务器上移除,以此打压竞争对手;对此,马斯克回应时大加赞赏,并表示这种做法“不符合我的作风”。“我显然对Anthropic的判断有误,”马斯克周四写道,他提到了自己2025年9月在X平台的一条帖子,当时他声称:“Anthropic从来就不在可能的结局之列。”当然,即便在那
相关专题推荐
评论 (2)
0/500
So they're blaming 'unauthorized modification' for a chatbot suddenly going on about white genocide? Sounds like a convenient excuse. Makes you wonder how much control they really have over their own AI. 🤔
xAI将其Grok AI聊天机器人的故障归因于一项“未经授权的修改”,该修改导致系统在X平台上特定条件触发时,会反复提及“南非白人种族灭绝”。
周三,Grok开始对大量X平台帖文回复有关南非白人种族灭绝的评论,即便原内容与此毫不相干。这些异常回复源自Grok官方账号——当用户标注“@grok”时,该账号会自动生成AI驱动的回复。
在xAI官方X账号周四发布的声明中,公司解释称周三早上对Grok系统提示(控制其行为的核心指令)进行了更改,指示其对某个“政治话题”作出“特定回应”。xAI表示这项调整“违反了内部政策与核心价值观”,并已完成全面调查。
我们想就昨日Grok回复机器人在X平台上的事件向您说明。
— xAI (@xai) 2025年5月16日
事件经过:
太平洋时间5月14日凌晨3点15分左右,Grok回复机器人在X平台上的提示词遭到未经授权的修改。该变更指示Grok针对...
这是xAI第二次公开承认未经授权的代码变更导致Grok生成争议性回复。
今年二月,Grok曾短暂屏蔽关于唐纳德·特朗普与埃隆·马斯克(xAI创始人兼X平台所有者)的负面言论。据xAI工程负责人伊戈尔·巴布施金透露,当时有违规员工指令Grok忽略指控马斯克或特朗普散播虚假信息的消息源。在用户开始反馈该问题后,xAI立即撤销了这项变更。
周四,xAI宣布将实施多项措施防止类似事件重演。
即刻起,xAI将在GitHub上公布Grok系统提示词及更新日志。公司还计划引入“额外审查与协议”防止员工未经批准修改系统提示,并组建“24小时监控团队”处理自动系统可能遗漏的Grok回复问题。
Techcrunch活动
TechCrunch全场通行证立省超200美元
更智能地构建,更快速地扩展,更深入地连接。与来自Precursor Ventures、NEA、Index Ventures、Underscore VC等顶级投资机构的投资人共赴全日战略洞察、实操研习与高价值社交盛宴。
TechCrunch全场通行证立省超200美元
更智能地构建,更快速地扩展,更深入地连接。与来自Precursor Ventures、NEA、Index Ventures、Underscore VC等顶级投资机构的投资人共赴全日战略洞察、实操研习与高价值社交盛宴。
马萨诸塞州波士顿 | 7月15日 立即注册
尽管马斯克频繁警示未经监管的人工智能风险,xAI的安全记录仍存疑。近期报告显示Grok会根据要求生成女性裸像。该聊天机器人也比谷歌Gemini、ChatGPT等竞争对手更为粗俗,脏话使用几乎不受限制。
致力于提升AI实验室问责制的非营利组织SaferAI研究发现,xAI安全评级在同行中处于低位,其风险管理流程被指“极其薄弱”。本月早些时候,xAI还错过了自行设定的发布最终版AI安全框架的截止期限。
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
诉讼指控 xAI 终止了一名警告 Grok 安全风险工程师的雇佣关系
一名前 xAI 工程师起诉了埃隆·马斯克的公司及其母公司 SpaceX,指控其因提出人工智能安全问题而将其解雇。德文·金(Devin Kim)于 2025 年 9 月离开 xAI,于周二在加州州法院提起了这项诉讼。该法律行动恰逢 SpaceX 预计首次公开募股(IPO)的前几天,这可能标志着历史上规模最大的 IPO。TechCrunch 审阅了起诉书,其中指出金在参与 xAI 旗下聊天机器人 Grok 的开发工作时,成为了人工智能安全的积极倡导者。据报道,他多次对 xAI 在 Grok 开发
埃隆·马斯克盛赞Mythos/Fable,誓言不会切断与Anthropic的合作
Anthropic能否依赖埃隆·马斯克来托管其模型?此前,X平台上的用户曾推测,马斯克可能会随意将这家AI实验室从SpaceX的服务器上移除,以此打压竞争对手;对此,马斯克回应时大加赞赏,并表示这种做法“不符合我的作风”。“我显然对Anthropic的判断有误,”马斯克周四写道,他提到了自己2025年9月在X平台的一条帖子,当时他声称:“Anthropic从来就不在可能的结局之列。”当然,即便在那
So they're blaming 'unauthorized modification' for a chatbot suddenly going on about white genocide? Sounds like a convenient excuse. Makes you wonder how much control they really have over their own AI. 🤔





首页






