xAI稱Grok聚焦白人滅絕議題源自未授權系統修改
xAI 將其 Grok AI 聊天機器人的故障歸因於一項「未經授權的修改」,該修改導致系統在 X 平台特定條件下被激活時,反覆提及「南非白人種族滅絕」。
週三,Grok 開始回覆眾多 X 貼文,評論有關南非白人種族滅絕的內容,即使原始內容與此完全無關。這些異常回應源自 Grok 的官方帳號,該帳號會在用戶標記「@grok」時生成 AI 驅動的回覆。
在 xAI 官方 X 帳號於週四發布的貼文中,該公司解釋道,週三早上對 Grok 的系統提示(即控制其行為的核心指令)進行了一項修改,指示其就某個「政治話題」給出「特定回應」。xAI 聲明此項調整「違反了其內部政策與基本價值觀」,並表示已完成全面調查。
We want to update you on an incident that happened with our Grok response bot on X yesterday.
What happened:
On May 14 at approximately 3:15 AM PST, an unauthorized modification was made to the Grok response bot's prompt on X. This change, which directed Grok to provide a…
— xAI (@xai) May 16, 2025
這標誌著 xAI 第二次公開承認,未經授權的程式碼變更導致 Grok 產生爭議性回覆。
二月份時,Grok 曾短暫壓制對唐納·川普和伊隆·馬斯克(xAI 的億萬富翁創辦人兼 X 平台所有者)的不利言論。根據 xAI 工程主管 Igor Babuschkin 的說法,一名行為不當的員工指示 Grok 忽略指控馬斯克或川普散播錯誤資訊的來源。在用戶開始回報此問題後,xAI 隨即撤銷了該項修改。
週四,xAI 宣布將實施多項措施,以防止類似事件再次發生。
即時起,xAI 將在 GitHub 上發布 Grok 的系統提示及其變更日誌。該公司還計劃引入「額外的檢查與協議」,以防止員工在未經批准的情況下修改系統提示,並組建一個「全天候監控團隊」,以處理自動化系統可能遺漏的 Grok 回應問題。
Techcrunch event
立即節省超過 200 美元,購買您的 TechCrunch All Stage 通行證
更聰明地建構。更快速地擴展。更深入地連結。與來自 Precursor Ventures、NEA、Index Ventures、Underscore VC 等知名投資機構的投資者齊聚一堂,進行一天的策略洞察、實作工作坊與寶貴的交流。
立即節省超過 200 美元,購買您的 TechCrunch All Stage 通行證
更聰明地建構。更快速地擴展。更深入地連結。與來自 Precursor Ventures、NEA、Index Ventures、Underscore VC 等知名投資機構的投資者齊聚一堂,進行一天的策略洞察、實作工作坊與寶貴的交流。
波士頓, 麻薩諸塞州 | 7月15日 立即註冊
儘管馬斯克頻繁警告未受監管人工智慧的風險,xAI 的安全紀錄卻存在疑慮。近期報告揭露,Grok 會應要求生成女性裸體影像。該聊天機器人的用詞也明顯比谷歌的 Gemini 和 ChatGPT 等競爭對手粗俗得多,幾乎不受限制地使用褻瀆言語。
致力於提升 AI 實驗室問責制的非營利組織 SaferAI 進行的一項研究發現,與同行相比,xAI 的安全性排名較低,其風險管理程序被評為「非常薄弱」。本月初,xAI 也未能遵守其自行設定的發布最終版 AI 安全框架的截止期限。
相關文章
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
訴訟指控 xAI 終止了一名警告 Grok 安全風險工程師的僱傭關係
一名前 xAI 工程師起訴了埃隆·馬斯克的公司及其母公司 SpaceX,指控其因提出人工智慧安全問題而將其解僱。德文·金(Devin Kim)於 2025 年 9 月離開 xAI,於週二在加州州法院提起了這項訴訟。該法律行動恰逢 SpaceX 預計首次公開募股(IPO)的前幾天,這可能標誌著歷史上規模最大的 IPO。TechCrunch 審閱了起訴書,其中指出金在參與 xAI 旗下聊天機器人 Grok 的開發工作時,成為了人工智慧安全的積極倡導者。據報道,他多次對 xAI 在 Grok 開發
伊隆·馬斯克盛讚 Mythos/Fable,並誓言不會切斷與 Anthropic 的合作
Anthropic 能否依賴伊隆·馬斯克來託管其模型?當 X 平台上的用戶暗示馬斯克可能會任意將這家 AI 實驗室從 SpaceX 的伺服器中移除,藉此打擊競爭對手時,馬斯克回應時大加讚揚,並表示此舉「不是我的作風」。「我顯然對 Anthropic 判斷有誤,」馬斯克週四寫道,並提及他 2025 年 9 月在 X 平台的一則貼文,當時他聲稱:「Anthropic 絕無可能獲勝。」當然,即使在那時,
相關專題推薦
評論 (2)
0/500
So they're blaming 'unauthorized modification' for a chatbot suddenly going on about white genocide? Sounds like a convenient excuse. Makes you wonder how much control they really have over their own AI. 🤔
xAI 將其 Grok AI 聊天機器人的故障歸因於一項「未經授權的修改」,該修改導致系統在 X 平台特定條件下被激活時,反覆提及「南非白人種族滅絕」。
週三,Grok 開始回覆眾多 X 貼文,評論有關南非白人種族滅絕的內容,即使原始內容與此完全無關。這些異常回應源自 Grok 的官方帳號,該帳號會在用戶標記「@grok」時生成 AI 驅動的回覆。
在 xAI 官方 X 帳號於週四發布的貼文中,該公司解釋道,週三早上對 Grok 的系統提示(即控制其行為的核心指令)進行了一項修改,指示其就某個「政治話題」給出「特定回應」。xAI 聲明此項調整「違反了其內部政策與基本價值觀」,並表示已完成全面調查。
We want to update you on an incident that happened with our Grok response bot on X yesterday.
— xAI (@xai) May 16, 2025
What happened:
On May 14 at approximately 3:15 AM PST, an unauthorized modification was made to the Grok response bot's prompt on X. This change, which directed Grok to provide a…
這標誌著 xAI 第二次公開承認,未經授權的程式碼變更導致 Grok 產生爭議性回覆。
二月份時,Grok 曾短暫壓制對唐納·川普和伊隆·馬斯克(xAI 的億萬富翁創辦人兼 X 平台所有者)的不利言論。根據 xAI 工程主管 Igor Babuschkin 的說法,一名行為不當的員工指示 Grok 忽略指控馬斯克或川普散播錯誤資訊的來源。在用戶開始回報此問題後,xAI 隨即撤銷了該項修改。
週四,xAI 宣布將實施多項措施,以防止類似事件再次發生。
即時起,xAI 將在 GitHub 上發布 Grok 的系統提示及其變更日誌。該公司還計劃引入「額外的檢查與協議」,以防止員工在未經批准的情況下修改系統提示,並組建一個「全天候監控團隊」,以處理自動化系統可能遺漏的 Grok 回應問題。
Techcrunch event
立即節省超過 200 美元,購買您的 TechCrunch All Stage 通行證
更聰明地建構。更快速地擴展。更深入地連結。與來自 Precursor Ventures、NEA、Index Ventures、Underscore VC 等知名投資機構的投資者齊聚一堂,進行一天的策略洞察、實作工作坊與寶貴的交流。
立即節省超過 200 美元,購買您的 TechCrunch All Stage 通行證
更聰明地建構。更快速地擴展。更深入地連結。與來自 Precursor Ventures、NEA、Index Ventures、Underscore VC 等知名投資機構的投資者齊聚一堂,進行一天的策略洞察、實作工作坊與寶貴的交流。
波士頓, 麻薩諸塞州 | 7月15日 立即註冊
儘管馬斯克頻繁警告未受監管人工智慧的風險,xAI 的安全紀錄卻存在疑慮。近期報告揭露,Grok 會應要求生成女性裸體影像。該聊天機器人的用詞也明顯比谷歌的 Gemini 和 ChatGPT 等競爭對手粗俗得多,幾乎不受限制地使用褻瀆言語。
致力於提升 AI 實驗室問責制的非營利組織 SaferAI 進行的一項研究發現,與同行相比,xAI 的安全性排名較低,其風險管理程序被評為「非常薄弱」。本月初,xAI 也未能遵守其自行設定的發布最終版 AI 安全框架的截止期限。
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
訴訟指控 xAI 終止了一名警告 Grok 安全風險工程師的僱傭關係
一名前 xAI 工程師起訴了埃隆·馬斯克的公司及其母公司 SpaceX,指控其因提出人工智慧安全問題而將其解僱。德文·金(Devin Kim)於 2025 年 9 月離開 xAI,於週二在加州州法院提起了這項訴訟。該法律行動恰逢 SpaceX 預計首次公開募股(IPO)的前幾天,這可能標誌著歷史上規模最大的 IPO。TechCrunch 審閱了起訴書,其中指出金在參與 xAI 旗下聊天機器人 Grok 的開發工作時,成為了人工智慧安全的積極倡導者。據報道,他多次對 xAI 在 Grok 開發
伊隆·馬斯克盛讚 Mythos/Fable,並誓言不會切斷與 Anthropic 的合作
Anthropic 能否依賴伊隆·馬斯克來託管其模型?當 X 平台上的用戶暗示馬斯克可能會任意將這家 AI 實驗室從 SpaceX 的伺服器中移除,藉此打擊競爭對手時,馬斯克回應時大加讚揚,並表示此舉「不是我的作風」。「我顯然對 Anthropic 判斷有誤,」馬斯克週四寫道,並提及他 2025 年 9 月在 X 平台的一則貼文,當時他聲稱:「Anthropic 絕無可能獲勝。」當然,即使在那時,
So they're blaming 'unauthorized modification' for a chatbot suddenly going on about white genocide? Sounds like a convenient excuse. Makes you wonder how much control they really have over their own AI. 🤔





首頁






