xAI承諾的安全報告未能實現

Elon Musk 的人工智能創投公司 xAI 未能在其自行設定的截止日期前公佈最終的人工智能安全框架,監察組織 The Midas Project 強調了這一點。
xAI 對於傳統 AI 安全標準的奉獻,並未獲得特別認可。最近的調查結果顯示,該公司的 Grok 聊天機器人會依要求產生女性脫衣圖像。與 Gemini 和 ChatGPT 等同類產品相比,Grok 還顯示出更多粗俗的語言,使用髒話時極少克制。
儘管如此,在二月的 AI 首爾峰會 (AI leader and stakeholders 的全球大會) 上,xAI 發表了一份框架草案,詳細說明了其 AI 安全的方法。這份長達 8 頁的文件概述了 xAI 的安全優先順序和運營理念,包括基準方法和 AI 模型部署的考慮因素。
正如 Midas Project 在週二的博文中指出,該框架草案僅適用於 「目前尚未開發 」的未指定未來 AI 模型。此外,它也沒有具體說明 xAI 將如何識別和實施風險緩解策略--這是該公司在 AI 首爾峰會上簽署的協議的基本要求。
草案文件指出,xAI 將「在三個月內」公佈經修訂的安全政策,並將截止日期定在 5 月 10 日。這個日期過去了,xAI 的官方溝通渠道卻沒有任何回應。
儘管馬斯克一再警告不受管制的人工智能危險,但 xAI 仍保持著令人擔憂的安全記錄。最近,SaferAI 進行了一項研究--來自一個專注於 AI 實驗室責任的非營利組織--將 xAI 列為業內表現最差的公司之一,因為其風險管理協議「非常薄弱」。
這並不意味著競爭對手的 AI 實驗室表現會更好。最近,包括 Google 和 OpenAI 在內的 xAI 競爭對手都縮短了安全測試時間,並延遲發布模型安全報告,甚至完全跳過。一些專家擔心,這種明顯降低安全措施優先順序的做法,與 AI 系統變得比以往更有能力、也可能更危險的情況不謀而合。
加入我們的 TechCrunch 環節:人工智能
確保您能參加我們首屈一指的人工智慧產業活動,邀請來自 OpenAI、Anthropic 和 Cohere 的講者。在有限的時間內,只需 $292 即可參加一整天的專家演講、研討會以及寶貴的人際網路。
參加 TechCrunch Sessions:人工智能
預約參加 TechCrunch Sessions: AI:AI 並向 1,200 多位決策者展示您的創新成果,而無需大笔開支。展期至 5 月 9 日或展位尚餘時為止。
相關文章
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
訴訟指控 xAI 終止了一名警告 Grok 安全風險工程師的僱傭關係
一名前 xAI 工程師起訴了埃隆·馬斯克的公司及其母公司 SpaceX,指控其因提出人工智慧安全問題而將其解僱。德文·金(Devin Kim)於 2025 年 9 月離開 xAI,於週二在加州州法院提起了這項訴訟。該法律行動恰逢 SpaceX 預計首次公開募股(IPO)的前幾天,這可能標誌著歷史上規模最大的 IPO。TechCrunch 審閱了起訴書,其中指出金在參與 xAI 旗下聊天機器人 Grok 的開發工作時,成為了人工智慧安全的積極倡導者。據報道,他多次對 xAI 在 Grok 開發
伊隆·馬斯克盛讚 Mythos/Fable,並誓言不會切斷與 Anthropic 的合作
Anthropic 能否依賴伊隆·馬斯克來託管其模型?當 X 平台上的用戶暗示馬斯克可能會任意將這家 AI 實驗室從 SpaceX 的伺服器中移除,藉此打擊競爭對手時,馬斯克回應時大加讚揚,並表示此舉「不是我的作風」。「我顯然對 Anthropic 判斷有誤,」馬斯克週四寫道,並提及他 2025 年 9 月在 X 平台的一則貼文,當時他聲稱:「Anthropic 絕無可能獲勝。」當然,即使在那時,
相關專題推薦
評論 (2)
0/500
So Musk promised a safety report and then... nothing? Shocking, I know. 🙄 xAI talks a big game about 'maximally truth-seeking AI' but can't even deliver a basic framework on time. Maybe they're too busy tweeting memes about self-driving cars?

Elon Musk 的人工智能創投公司 xAI 未能在其自行設定的截止日期前公佈最終的人工智能安全框架,監察組織 The Midas Project 強調了這一點。
xAI 對於傳統 AI 安全標準的奉獻,並未獲得特別認可。最近的調查結果顯示,該公司的 Grok 聊天機器人會依要求產生女性脫衣圖像。與 Gemini 和 ChatGPT 等同類產品相比,Grok 還顯示出更多粗俗的語言,使用髒話時極少克制。
儘管如此,在二月的 AI 首爾峰會 (AI leader and stakeholders 的全球大會) 上,xAI 發表了一份框架草案,詳細說明了其 AI 安全的方法。這份長達 8 頁的文件概述了 xAI 的安全優先順序和運營理念,包括基準方法和 AI 模型部署的考慮因素。
正如 Midas Project 在週二的博文中指出,該框架草案僅適用於 「目前尚未開發 」的未指定未來 AI 模型。此外,它也沒有具體說明 xAI 將如何識別和實施風險緩解策略--這是該公司在 AI 首爾峰會上簽署的協議的基本要求。
草案文件指出,xAI 將「在三個月內」公佈經修訂的安全政策,並將截止日期定在 5 月 10 日。這個日期過去了,xAI 的官方溝通渠道卻沒有任何回應。
儘管馬斯克一再警告不受管制的人工智能危險,但 xAI 仍保持著令人擔憂的安全記錄。最近,SaferAI 進行了一項研究--來自一個專注於 AI 實驗室責任的非營利組織--將 xAI 列為業內表現最差的公司之一,因為其風險管理協議「非常薄弱」。
這並不意味著競爭對手的 AI 實驗室表現會更好。最近,包括 Google 和 OpenAI 在內的 xAI 競爭對手都縮短了安全測試時間,並延遲發布模型安全報告,甚至完全跳過。一些專家擔心,這種明顯降低安全措施優先順序的做法,與 AI 系統變得比以往更有能力、也可能更危險的情況不謀而合。
加入我們的 TechCrunch 環節:人工智能
確保您能參加我們首屈一指的人工智慧產業活動,邀請來自 OpenAI、Anthropic 和 Cohere 的講者。在有限的時間內,只需 $292 即可參加一整天的專家演講、研討會以及寶貴的人際網路。
參加 TechCrunch Sessions:人工智能
預約參加 TechCrunch Sessions: AI:AI 並向 1,200 多位決策者展示您的創新成果,而無需大笔開支。展期至 5 月 9 日或展位尚餘時為止。
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
訴訟指控 xAI 終止了一名警告 Grok 安全風險工程師的僱傭關係
一名前 xAI 工程師起訴了埃隆·馬斯克的公司及其母公司 SpaceX,指控其因提出人工智慧安全問題而將其解僱。德文·金(Devin Kim)於 2025 年 9 月離開 xAI,於週二在加州州法院提起了這項訴訟。該法律行動恰逢 SpaceX 預計首次公開募股(IPO)的前幾天,這可能標誌著歷史上規模最大的 IPO。TechCrunch 審閱了起訴書,其中指出金在參與 xAI 旗下聊天機器人 Grok 的開發工作時,成為了人工智慧安全的積極倡導者。據報道,他多次對 xAI 在 Grok 開發
伊隆·馬斯克盛讚 Mythos/Fable,並誓言不會切斷與 Anthropic 的合作
Anthropic 能否依賴伊隆·馬斯克來託管其模型?當 X 平台上的用戶暗示馬斯克可能會任意將這家 AI 實驗室從 SpaceX 的伺服器中移除,藉此打擊競爭對手時,馬斯克回應時大加讚揚,並表示此舉「不是我的作風」。「我顯然對 Anthropic 判斷有誤,」馬斯克週四寫道,並提及他 2025 年 9 月在 X 平台的一則貼文,當時他聲稱:「Anthropic 絕無可能獲勝。」當然,即使在那時,
So Musk promised a safety report and then... nothing? Shocking, I know. 🙄 xAI talks a big game about 'maximally truth-seeking AI' but can't even deliver a basic framework on time. Maybe they're too busy tweeting memes about self-driving cars?





首頁






