Anthropic 因發現安全漏洞而暫緩推出新 AI 模型
# Nvidia
# Google
# Microsoft
# Anthropic
# agentic ai
# AI cybersecurity
# ai security
# amazon web services
# Claude Mythos
# CrowdStrike
# cybersecurity
# open source security
# Palo Alto Networks
# Project Glasswing
# vulnerability
# zero-day
Anthropic 最先進的人工智慧模型已識別出橫跨所有主要作業系統與網路瀏覽器的數千項網路安全漏洞。該公司選擇不對外公開發布,而是低調地將其提供給負責維護關鍵網路基礎設施的組織。
該模型名為「Claude Mythos Preview」,而這項計畫則稱為「Project Glasswing」。
首批合作夥伴包括亞馬遜網路服務(AWS)、蘋果、博通、思科、CrowdStrike、谷歌、摩根大通、Linux 基金會、微軟、NVIDIA 以及 Palo Alto Networks。
除了這群核心夥伴之外,Anthropic 還向另外 40 多個開發或維護關鍵軟體基礎設施的組織開放了存取權限。作為這項努力的一部分,Anthropic 承諾為 Mythos Preview 提供高達 1 億美元的使用額度,並向開源安全組織直接捐贈 400 萬美元。
超越自身基準的模型
Mythos Preview 並非專為網路安全任務而訓練。Anthropic 表示,其能力「是程式碼、推理與自主性全面提升所衍生的下游結果」,並指出那些使模型更擅長修補漏洞的進展,同時也增強了其利用漏洞的能力。
這一點至關重要。Mythos Preview 的表現已大幅超越現有安全基準,迫使 Anthropic 將焦點轉向嶄新的實務任務——具體而言,就是「零日漏洞」。這些漏洞是軟體開發人員先前未曾察覺的缺陷。
在發現的漏洞中,包括一個存在於 OpenBSD(一款以強大安全性著稱的作業系統)中長達 27 年的漏洞。 在另一案例中,該模型自主識別並利用了 FreeBSD 中一個存在 17 年的遠端程式碼執行漏洞——CVE-2026-4747——此漏洞允許網際網路上的任何未經認證使用者,完全控制運行 NFS 的伺服器。在最初被提示尋找此漏洞後,後續的發現與利用過程均未涉及任何人工介入。
Anthropic 研究團隊的 Nicholas Carlini 描述了該模型串聯漏洞的能力:「此模型能透過依序組合三、四,有時甚至五個漏洞來建立攻擊程式,從而達成高度複雜的攻擊效果。我在過去幾週內發現的漏洞,比我職業生涯中其餘時間的總和還要多。」
為何不對外發布?
Anthropic 前沿紅隊網路安全主管 Newton Cheng 表示:「鑑於其網路安全能力,我們不打算將 Claude Mythos Preview 對外公開。考量到人工智慧發展的迅猛速度,這類能力很快就會普及,甚至可能落入不願安全部署這些技術的行為者手中。這對經濟、公共安全及國家安全造成的衝擊可能極為嚴重。」
這項擔憂絕非空穴來風。Anthropic 先前曾披露一宗被其描述為「首個經證實主要由 AI 執行的網路攻擊案例」——一個由中國政府資助的組織利用 AI 代理自主滲透約 30 個全球目標,其中多數戰術行動均由 AI 獨立處理。
該公司亦已私下向美國政府高層簡報 Mythos Preview 的完整能力。情報界目前正積極評估該模型將如何重塑攻防兩端的駭客行動。
開源軟體的難題
「玻璃翼計畫」超越了這項備受矚目的聯盟,其另一項重點在於開源軟體。Linux 基金會執行長吉姆·澤姆林(Jim Zemlin)直言:「過去,資安專業知識是僅限於擁有龐大資安團隊的組織才能享有的奢侈品。開源維護者所開發的軟體支撐著全球大部分關鍵基礎設施,但歷史上他們卻總是被放任自生自滅,必須自行摸索資安解決方案。」
Anthropic 已透過 Linux 基金會向 Alpha-Omega 和 OpenSSF 捐贈 250 萬美元,並向 Apache 軟體基金會捐贈 150 萬美元——這使關鍵開源程式碼庫的維護者能夠以過去難以企及的規模,使用人工智慧驅動的網路安全漏洞掃描服務。
下一步
Anthropic 表示,其長期目標是大規模部署 Mythos 級別的模型,但前提是必須先建立完善的新防護措施。該公司計劃首先透過即將推出的 Claude Opus 模型引入這些新防護措施,藉此利用一個風險程度低於 Mythos Preview 的模型來完善這些機制。
圍繞這項發展,競爭格局已然產生變化。當 OpenAI 於二月發布 GPT-5.3-Codex 時,該公司稱其為首個在「準備度框架」下被歸類為具備高網路安全任務能力的模型。Anthropic 透過 Glasswing 採取的行動,顯示領先的人工智慧實驗室認為,對於此能力層級的模型而言,受控部署——而非公開發布——正成為新興標準。
隨著這類能力日益普及,該標準能否持續成立,目前仍是個開放性問題,沒有任何單一舉措能給出明確答案。
另請參閱:Anthropic拒絕讓AI「武裝」自身,這正是英國所需要的

想向業界領袖深入了解 AI 與大數據?歡迎參加將於阿姆斯特丹、加州及倫敦舉辦的「AI & Big Data Expo」。這場綜合性盛會隸屬於 TechEx 系列,並與其他頂尖科技活動(包括「網路安全與雲端博覽會」)同期舉行。點擊此處獲取更多資訊。
AI News 由 TechForge Media 提供技術支援。點此探索其他即將舉行的企業科技活動與線上研討會。
相關文章
Anthropic 推出 Opus 4.8,搭載全新的動態工作流程工具
Anthropic 於週四正式推出 Opus 4.8,這是其旗艦級公開模型的最新版本。此版本定價與前一版本相同,現已於所有平台上線。距離 Opus 4.7 發布僅隔 41 天,Anthropic 顯著加快了開發週期,遠快於近期 Sonnet 和 Haiku 版本所見的三個月及七個月間隔。此次快速更新很可能是為了回應 Opus 4.7 所獲得的冷淡反響,該版本曾讓許多使用者感到失望。與此同時,Ope
Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙
Google 週二宣布,Android 將推出「虛假來電偵測」功能,以防範利用人工智慧深度偽造技術進行的冒充詐騙。此功能將於本月透過「Phone by Google」在全球範圍內逐步推送至 Android 12 及以上版本的裝置,首先從 Pixel 裝置開始。隨著人們越來越不願接聽未知號碼的來電,詐騙者正改變策略,透過偽造可信賴的電話號碼,並利用 AI 深度偽造技術,讓聲音聽起來像是權威人士、家人
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
相關專題推薦
評論 (0)
0/500
Anthropic 最先進的人工智慧模型已識別出橫跨所有主要作業系統與網路瀏覽器的數千項網路安全漏洞。該公司選擇不對外公開發布,而是低調地將其提供給負責維護關鍵網路基礎設施的組織。
該模型名為「Claude Mythos Preview」,而這項計畫則稱為「Project Glasswing」。
首批合作夥伴包括亞馬遜網路服務(AWS)、蘋果、博通、思科、CrowdStrike、谷歌、摩根大通、Linux 基金會、微軟、NVIDIA 以及 Palo Alto Networks。
除了這群核心夥伴之外,Anthropic 還向另外 40 多個開發或維護關鍵軟體基礎設施的組織開放了存取權限。作為這項努力的一部分,Anthropic 承諾為 Mythos Preview 提供高達 1 億美元的使用額度,並向開源安全組織直接捐贈 400 萬美元。
超越自身基準的模型
Mythos Preview 並非專為網路安全任務而訓練。Anthropic 表示,其能力「是程式碼、推理與自主性全面提升所衍生的下游結果」,並指出那些使模型更擅長修補漏洞的進展,同時也增強了其利用漏洞的能力。
這一點至關重要。Mythos Preview 的表現已大幅超越現有安全基準,迫使 Anthropic 將焦點轉向嶄新的實務任務——具體而言,就是「零日漏洞」。這些漏洞是軟體開發人員先前未曾察覺的缺陷。
在發現的漏洞中,包括一個存在於 OpenBSD(一款以強大安全性著稱的作業系統)中長達 27 年的漏洞。 在另一案例中,該模型自主識別並利用了 FreeBSD 中一個存在 17 年的遠端程式碼執行漏洞——CVE-2026-4747——此漏洞允許網際網路上的任何未經認證使用者,完全控制運行 NFS 的伺服器。在最初被提示尋找此漏洞後,後續的發現與利用過程均未涉及任何人工介入。
Anthropic 研究團隊的 Nicholas Carlini 描述了該模型串聯漏洞的能力:「此模型能透過依序組合三、四,有時甚至五個漏洞來建立攻擊程式,從而達成高度複雜的攻擊效果。我在過去幾週內發現的漏洞,比我職業生涯中其餘時間的總和還要多。」
為何不對外發布?
Anthropic 前沿紅隊網路安全主管 Newton Cheng 表示:「鑑於其網路安全能力,我們不打算將 Claude Mythos Preview 對外公開。考量到人工智慧發展的迅猛速度,這類能力很快就會普及,甚至可能落入不願安全部署這些技術的行為者手中。這對經濟、公共安全及國家安全造成的衝擊可能極為嚴重。」
這項擔憂絕非空穴來風。Anthropic 先前曾披露一宗被其描述為「首個經證實主要由 AI 執行的網路攻擊案例」——一個由中國政府資助的組織利用 AI 代理自主滲透約 30 個全球目標,其中多數戰術行動均由 AI 獨立處理。
該公司亦已私下向美國政府高層簡報 Mythos Preview 的完整能力。情報界目前正積極評估該模型將如何重塑攻防兩端的駭客行動。
開源軟體的難題
「玻璃翼計畫」超越了這項備受矚目的聯盟,其另一項重點在於開源軟體。Linux 基金會執行長吉姆·澤姆林(Jim Zemlin)直言:「過去,資安專業知識是僅限於擁有龐大資安團隊的組織才能享有的奢侈品。開源維護者所開發的軟體支撐著全球大部分關鍵基礎設施,但歷史上他們卻總是被放任自生自滅,必須自行摸索資安解決方案。」
Anthropic 已透過 Linux 基金會向 Alpha-Omega 和 OpenSSF 捐贈 250 萬美元,並向 Apache 軟體基金會捐贈 150 萬美元——這使關鍵開源程式碼庫的維護者能夠以過去難以企及的規模,使用人工智慧驅動的網路安全漏洞掃描服務。
下一步
Anthropic 表示,其長期目標是大規模部署 Mythos 級別的模型,但前提是必須先建立完善的新防護措施。該公司計劃首先透過即將推出的 Claude Opus 模型引入這些新防護措施,藉此利用一個風險程度低於 Mythos Preview 的模型來完善這些機制。
圍繞這項發展,競爭格局已然產生變化。當 OpenAI 於二月發布 GPT-5.3-Codex 時,該公司稱其為首個在「準備度框架」下被歸類為具備高網路安全任務能力的模型。Anthropic 透過 Glasswing 採取的行動,顯示領先的人工智慧實驗室認為,對於此能力層級的模型而言,受控部署——而非公開發布——正成為新興標準。
隨著這類能力日益普及,該標準能否持續成立,目前仍是個開放性問題,沒有任何單一舉措能給出明確答案。
另請參閱:Anthropic拒絕讓AI「武裝」自身,這正是英國所需要的

想向業界領袖深入了解 AI 與大數據?歡迎參加將於阿姆斯特丹、加州及倫敦舉辦的「AI & Big Data Expo」。這場綜合性盛會隸屬於 TechEx 系列,並與其他頂尖科技活動(包括「網路安全與雲端博覽會」)同期舉行。點擊此處獲取更多資訊。
AI News 由 TechForge Media 提供技術支援。點此探索其他即將舉行的企業科技活動與線上研討會。
Anthropic 推出 Opus 4.8,搭載全新的動態工作流程工具
Anthropic 於週四正式推出 Opus 4.8,這是其旗艦級公開模型的最新版本。此版本定價與前一版本相同,現已於所有平台上線。距離 Opus 4.7 發布僅隔 41 天,Anthropic 顯著加快了開發週期,遠快於近期 Sonnet 和 Haiku 版本所見的三個月及七個月間隔。此次快速更新很可能是為了回應 Opus 4.7 所獲得的冷淡反響,該版本曾讓許多使用者感到失望。與此同時,Ope
Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙
Google 週二宣布,Android 將推出「虛假來電偵測」功能,以防範利用人工智慧深度偽造技術進行的冒充詐騙。此功能將於本月透過「Phone by Google」在全球範圍內逐步推送至 Android 12 及以上版本的裝置,首先從 Pixel 裝置開始。隨著人們越來越不願接聽未知號碼的來電,詐騙者正改變策略,透過偽造可信賴的電話號碼,並利用 AI 深度偽造技術,讓聲音聽起來像是權威人士、家人
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr





首頁






