美國禁止使用 Anthropic 模型一事,並非與 AI 越獄有關

美國政府近期致 Anthropic 的一封執法函,實際上迫使該公司在週末前將其最新的人工智慧模型下線,這應成為所有美國科技公司——無論是否為人工智慧實驗室——的一記嚴正警告。
以下是事件簡要回顧:上週五下午,美國商務部向 Anthropic 發出一封信函,援引一項鮮為人知的出口管制規定,以未具體說明的國家安全顧慮為由,禁止非美國公民——包括 Anthropic 自身的員工——存取 Fable 5 和 Mythos 5 模型。 Anthropic 表示,他們認為這封信與模型安全防護機制遭繞過有關,但由於信中缺乏具體細節,因此無法確定。該信函尚未對外公開。
作為回應,Anthropic 為確保遵守該指令,已針對所有客戶關閉其兩款旗艦模型。結果,美國政府透過一項看似無需法院批准的迅速單方面行動,成功迫使這家科技公司將其模型下線。
川普政府週五的干預顯示,人工智慧產業並非免疫於政府干預。這也向科技界傳達了一個更廣泛的訊息:遵守規定,否則我們可以同時關停貴公司及其產品。
Axios 援引消息來源指出,上週末兩大陣營之間局勢緊張,暗示是 Anthropic 與川普政府之間的「個性差異」——而非 AI 產品中的技術缺陷——觸發了這項出口指令。
週末浮現的新細節,進一步動搖了政府原本就備受質疑的論點。
資深網路安全專家、研究員暨 Luta Security 創辦人凱蒂·穆索里斯(Katie Moussouris)在一篇部落格文章中寫道,Anthropic 最近與她分享了一份由安全研究人員撰寫的論文私密副本,該論文描述了 Fable 5 中據稱存在的一項防護機制繞過漏洞。 (《華爾街日報》報導指出,該論文的作者是亞馬遜的安全研究人員。)穆索里斯表示,Anthropic 曾主動聯繫她,徵求她對該論文的看法。
在她的部落格文章中,穆索里斯描述了研究人員如何觸發該安全防護機制的繞過,但同時指出,該繞過行為本身「本不應觸發出口管制」。 關鍵區別在於,要求 AI 模型「審查程式碼的安全問題」與要求它「修復這段程式碼」之間的差異。即使問題的措辭略有不同,最終結果在很大程度上仍是相同的。
「論文中描述的行為無法實質性地修正,任何嘗試只會削弱模型的防禦能力,」穆索里斯表示,她批評這項出口管制指令既倉促、又粗暴,且方向錯誤。
穆蘇里斯連同數十位頂尖資安研究人員與專家,隨後呼籲川普政府撤銷這項出口管制命令,並稱此舉剝奪美國網路防禦人員的先進資安能力是「危險的」。
歷屆政府曾基於認知缺口做出過廣泛的決策。例如,美國政府在2010年代為修訂涉及網路安全工具的出口法規時(這些工具亦可能被用於網路攻擊),所採用的措辭過於寬泛,以致無意間幾乎將合法的安全與漏洞研究定為非法。
然而,川普政府的這項指令似乎帶有報復性質。
《Tech Policy Press》主編賈斯汀·亨德里克斯(Justin Hendrix)表示,川普政府的此舉「很可能讓各國首都對美國人工智慧在關鍵應用中的可靠性感到擔憂」。這傳達出的訊息是:若沒有美國政府的干預,美國的人工智慧公司是不可信賴的。
川普政府尚未證實為何援引這項出口管制指令。是官員們誤解了報告內容並反應過度嗎?還是亞馬遜執行長安迪·賈西(Andy Jassy)向政府高層說了什麼話,促使當局出於謹慎或報復心理做出此回應? 是翻譯過程出現疏漏,還是這其實是向Anthropic施壓的手段——畢竟該公司與政府本就關係緊張?也有可能白宮當時並未意識到這封信中要求的深遠影響,而官員們現在正忙著彌補他們造成的損害。
引用亨德里克斯的話說:「當前氛圍瀰漫著一股猜疑,人們懷疑高級官員正基於個人和政治因素而偏袒特定對象。」其後果是,政府在對美國製造軟體的發布意圖施加多少控制方面,已樹立了一個危險的先例。
這次,政府將矛頭指向 Anthropic;明天,目標就可能是任何其他對象。
相關文章
Anthropic 推出 Opus 4.8,搭載全新的動態工作流程工具
Anthropic 於週四正式推出 Opus 4.8,這是其旗艦級公開模型的最新版本。此版本定價與前一版本相同,現已於所有平台上線。距離 Opus 4.7 發布僅隔 41 天,Anthropic 顯著加快了開發週期,遠快於近期 Sonnet 和 Haiku 版本所見的三個月及七個月間隔。此次快速更新很可能是為了回應 Opus 4.7 所獲得的冷淡反響,該版本曾讓許多使用者感到失望。與此同時,Ope
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
Anthropic 推出 Fable:一款更實惠、限制更少的 AI 模型
Anthropic 於週二推出了 Fable 和 Mythos 5.1,提供了其最新 AI 技術的配對迭代版本。除了效能提升外,更新後的 Fable 版本還減少了令牌使用量,並收緊了安全過濾器,以最大限度地減少誤報限制。與其前身一樣,Mythos 5.1 僅限於專注於網路安全或生命科學的已驗證 Anthropic 合作伙伴。不受限制的 Fable 5.1 現在可透過雲平臺以及 Anthropic API 訪問。一項關鍵更新是採用了零資料保留策略,使客戶能夠在不洩露資料的情況下,將 Anthr
相關專題推薦
評論 (0)
0/500

美國政府近期致 Anthropic 的一封執法函,實際上迫使該公司在週末前將其最新的人工智慧模型下線,這應成為所有美國科技公司——無論是否為人工智慧實驗室——的一記嚴正警告。
以下是事件簡要回顧:上週五下午,美國商務部向 Anthropic 發出一封信函,援引一項鮮為人知的出口管制規定,以未具體說明的國家安全顧慮為由,禁止非美國公民——包括 Anthropic 自身的員工——存取 Fable 5 和 Mythos 5 模型。 Anthropic 表示,他們認為這封信與模型安全防護機制遭繞過有關,但由於信中缺乏具體細節,因此無法確定。該信函尚未對外公開。
作為回應,Anthropic 為確保遵守該指令,已針對所有客戶關閉其兩款旗艦模型。結果,美國政府透過一項看似無需法院批准的迅速單方面行動,成功迫使這家科技公司將其模型下線。
川普政府週五的干預顯示,人工智慧產業並非免疫於政府干預。這也向科技界傳達了一個更廣泛的訊息:遵守規定,否則我們可以同時關停貴公司及其產品。
Axios 援引消息來源指出,上週末兩大陣營之間局勢緊張,暗示是 Anthropic 與川普政府之間的「個性差異」——而非 AI 產品中的技術缺陷——觸發了這項出口指令。
週末浮現的新細節,進一步動搖了政府原本就備受質疑的論點。
資深網路安全專家、研究員暨 Luta Security 創辦人凱蒂·穆索里斯(Katie Moussouris)在一篇部落格文章中寫道,Anthropic 最近與她分享了一份由安全研究人員撰寫的論文私密副本,該論文描述了 Fable 5 中據稱存在的一項防護機制繞過漏洞。 (《華爾街日報》報導指出,該論文的作者是亞馬遜的安全研究人員。)穆索里斯表示,Anthropic 曾主動聯繫她,徵求她對該論文的看法。
在她的部落格文章中,穆索里斯描述了研究人員如何觸發該安全防護機制的繞過,但同時指出,該繞過行為本身「本不應觸發出口管制」。 關鍵區別在於,要求 AI 模型「審查程式碼的安全問題」與要求它「修復這段程式碼」之間的差異。即使問題的措辭略有不同,最終結果在很大程度上仍是相同的。
「論文中描述的行為無法實質性地修正,任何嘗試只會削弱模型的防禦能力,」穆索里斯表示,她批評這項出口管制指令既倉促、又粗暴,且方向錯誤。
穆蘇里斯連同數十位頂尖資安研究人員與專家,隨後呼籲川普政府撤銷這項出口管制命令,並稱此舉剝奪美國網路防禦人員的先進資安能力是「危險的」。
歷屆政府曾基於認知缺口做出過廣泛的決策。例如,美國政府在2010年代為修訂涉及網路安全工具的出口法規時(這些工具亦可能被用於網路攻擊),所採用的措辭過於寬泛,以致無意間幾乎將合法的安全與漏洞研究定為非法。
然而,川普政府的這項指令似乎帶有報復性質。
《Tech Policy Press》主編賈斯汀·亨德里克斯(Justin Hendrix)表示,川普政府的此舉「很可能讓各國首都對美國人工智慧在關鍵應用中的可靠性感到擔憂」。這傳達出的訊息是:若沒有美國政府的干預,美國的人工智慧公司是不可信賴的。
川普政府尚未證實為何援引這項出口管制指令。是官員們誤解了報告內容並反應過度嗎?還是亞馬遜執行長安迪·賈西(Andy Jassy)向政府高層說了什麼話,促使當局出於謹慎或報復心理做出此回應? 是翻譯過程出現疏漏,還是這其實是向Anthropic施壓的手段——畢竟該公司與政府本就關係緊張?也有可能白宮當時並未意識到這封信中要求的深遠影響,而官員們現在正忙著彌補他們造成的損害。
引用亨德里克斯的話說:「當前氛圍瀰漫著一股猜疑,人們懷疑高級官員正基於個人和政治因素而偏袒特定對象。」其後果是,政府在對美國製造軟體的發布意圖施加多少控制方面,已樹立了一個危險的先例。
這次,政府將矛頭指向 Anthropic;明天,目標就可能是任何其他對象。
Anthropic 推出 Opus 4.8,搭載全新的動態工作流程工具
Anthropic 於週四正式推出 Opus 4.8,這是其旗艦級公開模型的最新版本。此版本定價與前一版本相同,現已於所有平台上線。距離 Opus 4.7 發布僅隔 41 天,Anthropic 顯著加快了開發週期,遠快於近期 Sonnet 和 Haiku 版本所見的三個月及七個月間隔。此次快速更新很可能是為了回應 Opus 4.7 所獲得的冷淡反響,該版本曾讓許多使用者感到失望。與此同時,Ope
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
Anthropic 推出 Fable:一款更實惠、限制更少的 AI 模型
Anthropic 於週二推出了 Fable 和 Mythos 5.1,提供了其最新 AI 技術的配對迭代版本。除了效能提升外,更新後的 Fable 版本還減少了令牌使用量,並收緊了安全過濾器,以最大限度地減少誤報限制。與其前身一樣,Mythos 5.1 僅限於專注於網路安全或生命科學的已驗證 Anthropic 合作伙伴。不受限制的 Fable 5.1 現在可透過雲平臺以及 Anthropic API 訪問。一項關鍵更新是採用了零資料保留策略,使客戶能夠在不洩露資料的情況下,將 Anthr





首頁






