Anthropic 在完成安全審查後部署了先進的人工智慧模型
# Nvidia
# Google
# Microsoft
# Anthropic
# agentic ai
# AI cybersecurity
# ai security
# amazon web services
# Claude Mythos
# CrowdStrike
# cybersecurity
# open source security
# Palo Alto Networks
# Project Glasswing
# vulnerability
# zero-day
Anthropic 最先進的人工智慧模型已發現橫跨各大作業系統與網路瀏覽器的數千項網路安全漏洞。該公司並未將其公開發布,而是低調地提供給負責守護網際網路核心基礎設施的相關組織。
該模型名為「Claude Mythos Preview」,此計畫則命名為「Project Glasswing」。
初期合作夥伴包括亞馬遜網路服務(AWS)、蘋果、博通、思科、CrowdStrike、谷歌、摩根大通、Linux 基金會、微軟、NVIDIA 以及 Palo Alto Networks。
除了這群核心夥伴之外,Anthropic 還向另外 40 多個開發或維護關鍵軟體基礎設施的組織開放了存取權限。該公司承諾在整個計畫中,為 Mythos Preview 提供高達 1 億美元的使用額度,並向開源安全組織直接捐贈 400 萬美元。
超越自身基準的模型
Mythos Preview 並非專為網路安全而訓練。Anthropic 表示,其能力「是程式碼生成、推理及自主運作方面廣泛改進的自然結果」。使該模型擅長修復漏洞的相同進展,也增強了其發現並利用漏洞的能力。
這種雙重能力意義重大。Mythos Preview 已發展到幾乎達到現有安全基準的極限,迫使 Anthropic 將重心轉向嶄新的現實世界挑戰——具體而言,就是零日漏洞。這些是連軟體開發者本身都未曾知曉的安全缺陷。
其發現的漏洞中,包含一個存在於 OpenBSD(一款以強大安全性著稱的作業系統)中長達 27 年的漏洞。在另一案例中,該模型自主識別並利用了 FreeBSD 中一個存在 17 年的遠端程式碼執行漏洞——CVE-2026-4747。此漏洞允許網際網路上的任何未經認證使用者,完全控制運行 NFS 服務的伺服器。 除了最初尋找漏洞的指令外,整個過程無需任何人工干預。
Anthropic 研究團隊的 Nicholas Carlini 特別強調了該模型串聯漏洞的能力:「此模型能利用三個、四個,有時甚至五個不同的漏洞,透過序列組合構建出攻擊手段,從而達成極其複雜的攻擊效果。我在過去幾週發現的漏洞數量,已超過我此前整個職業生涯的總和。」
為何不對外公開?
Anthropic 的 Frontier Red Team 網路安全負責人 Newton Cheng 表示:「鑑於其先進的網路安全能力,我們不打算將 Claude Mythos Preview 對外公開。」「考量到人工智慧發展的迅猛速度,這類能力很可能很快就會普及,甚至可能落入無法安全部署這些技術的行為者手中。這對經濟、公共安全及國家安全可能造成的後果將十分嚴重。」
這項擔憂並非空談。Anthropic 先前曾披露一樁被稱為「首起由 AI 主導的網路攻擊實例」的事件——一個受中國政府資助的組織利用 AI 代理程式自主滲透約 30 個全球目標,其中大部分戰術行動均由 AI 獨立執行。
該公司亦已私下向美國政府高層簡報 Mythos Preview 的完整能力。情報界目前正積極評估此類模型將如何改變攻防兩端的網路作戰模式。
應對開源軟體的挑戰
「Glasswing 計畫」的核心要點不僅限於其頭條合作夥伴:更在於保障開源軟體的安全。Linux 基金會執行長 Jim Zemlin 直言:「歷史上,安全專業知識向來是擁有龐大安全團隊的組織才能享有的奢侈品。開源維護者所開發的軟體支撐著全球大部分關鍵基礎設施,卻往往只能靠自己處理安全問題。」
為解決此問題,Anthropic 已透過 Linux 基金會向 Alpha-Omega 和 OpenSSF 捐贈 250 萬美元,並向 Apache 軟體基金會捐贈 150 萬美元。這使關鍵開源專案的維護者能夠以過去無法企及的規模,使用 AI 驅動的漏洞掃描服務。
後續發展
Anthropic 表示,其長期目標是在大規模部署 Mythos 級別模型之前,先實施新的安全防護措施。該公司計劃首先在即將推出的 Claude Opus 模型中引入這些防護措施,以便在將其應用於 Mythos Preview 之前,透過風險較低的系統進行優化。
競爭格局已然轉變。當 OpenAI 於二月發布 GPT-5.3-Codex 時,該公司將此模型標示為其「準備度框架」下首個被歸類為具備「高能力」的網路安全模型。Anthropic 的 Glasswing 計畫顯示,領先的人工智慧實驗室認為,對於具備此等級能力的模型而言,受控且有限的部署——而非公開發布——正成為新興標準。
隨著這些強大能力日益普及,此標準能否持續維持,仍是個開放性問題,沒有任何單一計畫能給出明確答案。
另請參閱:Anthropic拒絕為AI「武裝」正是英國所需要的

想向業界領袖深入了解 AI 與大數據?歡迎參加將於阿姆斯特丹、加州及倫敦舉辦的 AI & Big Data Expo。這場綜合性盛會隸屬於 TechEx 系列,並與其他頂尖科技活動(包括網路安全與雲端博覽會)同期舉行。點擊此處獲取更多資訊。
AI News 由 TechForge Media 提供技術支援。點此探索其他即將舉行的企業科技活動與線上研討會。
相關文章
Anthropic 推出 Opus 4.8,搭載全新的動態工作流程工具
Anthropic 於週四正式推出 Opus 4.8,這是其旗艦級公開模型的最新版本。此版本定價與前一版本相同,現已於所有平台上線。距離 Opus 4.7 發布僅隔 41 天,Anthropic 顯著加快了開發週期,遠快於近期 Sonnet 和 Haiku 版本所見的三個月及七個月間隔。此次快速更新很可能是為了回應 Opus 4.7 所獲得的冷淡反響,該版本曾讓許多使用者感到失望。與此同時,Ope
Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙
Google 週二宣布,Android 將推出「虛假來電偵測」功能,以防範利用人工智慧深度偽造技術進行的冒充詐騙。此功能將於本月透過「Phone by Google」在全球範圍內逐步推送至 Android 12 及以上版本的裝置,首先從 Pixel 裝置開始。隨著人們越來越不願接聽未知號碼的來電,詐騙者正改變策略,透過偽造可信賴的電話號碼,並利用 AI 深度偽造技術,讓聲音聽起來像是權威人士、家人
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
相關專題推薦
評論 (0)
0/500
Anthropic 最先進的人工智慧模型已發現橫跨各大作業系統與網路瀏覽器的數千項網路安全漏洞。該公司並未將其公開發布,而是低調地提供給負責守護網際網路核心基礎設施的相關組織。
該模型名為「Claude Mythos Preview」,此計畫則命名為「Project Glasswing」。
初期合作夥伴包括亞馬遜網路服務(AWS)、蘋果、博通、思科、CrowdStrike、谷歌、摩根大通、Linux 基金會、微軟、NVIDIA 以及 Palo Alto Networks。
除了這群核心夥伴之外,Anthropic 還向另外 40 多個開發或維護關鍵軟體基礎設施的組織開放了存取權限。該公司承諾在整個計畫中,為 Mythos Preview 提供高達 1 億美元的使用額度,並向開源安全組織直接捐贈 400 萬美元。
超越自身基準的模型
Mythos Preview 並非專為網路安全而訓練。Anthropic 表示,其能力「是程式碼生成、推理及自主運作方面廣泛改進的自然結果」。使該模型擅長修復漏洞的相同進展,也增強了其發現並利用漏洞的能力。
這種雙重能力意義重大。Mythos Preview 已發展到幾乎達到現有安全基準的極限,迫使 Anthropic 將重心轉向嶄新的現實世界挑戰——具體而言,就是零日漏洞。這些是連軟體開發者本身都未曾知曉的安全缺陷。
其發現的漏洞中,包含一個存在於 OpenBSD(一款以強大安全性著稱的作業系統)中長達 27 年的漏洞。在另一案例中,該模型自主識別並利用了 FreeBSD 中一個存在 17 年的遠端程式碼執行漏洞——CVE-2026-4747。此漏洞允許網際網路上的任何未經認證使用者,完全控制運行 NFS 服務的伺服器。 除了最初尋找漏洞的指令外,整個過程無需任何人工干預。
Anthropic 研究團隊的 Nicholas Carlini 特別強調了該模型串聯漏洞的能力:「此模型能利用三個、四個,有時甚至五個不同的漏洞,透過序列組合構建出攻擊手段,從而達成極其複雜的攻擊效果。我在過去幾週發現的漏洞數量,已超過我此前整個職業生涯的總和。」
為何不對外公開?
Anthropic 的 Frontier Red Team 網路安全負責人 Newton Cheng 表示:「鑑於其先進的網路安全能力,我們不打算將 Claude Mythos Preview 對外公開。」「考量到人工智慧發展的迅猛速度,這類能力很可能很快就會普及,甚至可能落入無法安全部署這些技術的行為者手中。這對經濟、公共安全及國家安全可能造成的後果將十分嚴重。」
這項擔憂並非空談。Anthropic 先前曾披露一樁被稱為「首起由 AI 主導的網路攻擊實例」的事件——一個受中國政府資助的組織利用 AI 代理程式自主滲透約 30 個全球目標,其中大部分戰術行動均由 AI 獨立執行。
該公司亦已私下向美國政府高層簡報 Mythos Preview 的完整能力。情報界目前正積極評估此類模型將如何改變攻防兩端的網路作戰模式。
應對開源軟體的挑戰
「Glasswing 計畫」的核心要點不僅限於其頭條合作夥伴:更在於保障開源軟體的安全。Linux 基金會執行長 Jim Zemlin 直言:「歷史上,安全專業知識向來是擁有龐大安全團隊的組織才能享有的奢侈品。開源維護者所開發的軟體支撐著全球大部分關鍵基礎設施,卻往往只能靠自己處理安全問題。」
為解決此問題,Anthropic 已透過 Linux 基金會向 Alpha-Omega 和 OpenSSF 捐贈 250 萬美元,並向 Apache 軟體基金會捐贈 150 萬美元。這使關鍵開源專案的維護者能夠以過去無法企及的規模,使用 AI 驅動的漏洞掃描服務。
後續發展
Anthropic 表示,其長期目標是在大規模部署 Mythos 級別模型之前,先實施新的安全防護措施。該公司計劃首先在即將推出的 Claude Opus 模型中引入這些防護措施,以便在將其應用於 Mythos Preview 之前,透過風險較低的系統進行優化。
競爭格局已然轉變。當 OpenAI 於二月發布 GPT-5.3-Codex 時,該公司將此模型標示為其「準備度框架」下首個被歸類為具備「高能力」的網路安全模型。Anthropic 的 Glasswing 計畫顯示,領先的人工智慧實驗室認為,對於具備此等級能力的模型而言,受控且有限的部署——而非公開發布——正成為新興標準。
隨著這些強大能力日益普及,此標準能否持續維持,仍是個開放性問題,沒有任何單一計畫能給出明確答案。
另請參閱:Anthropic拒絕為AI「武裝」正是英國所需要的

想向業界領袖深入了解 AI 與大數據?歡迎參加將於阿姆斯特丹、加州及倫敦舉辦的 AI & Big Data Expo。這場綜合性盛會隸屬於 TechEx 系列,並與其他頂尖科技活動(包括網路安全與雲端博覽會)同期舉行。點擊此處獲取更多資訊。
AI News 由 TechForge Media 提供技術支援。點此探索其他即將舉行的企業科技活動與線上研討會。
Anthropic 推出 Opus 4.8,搭載全新的動態工作流程工具
Anthropic 於週四正式推出 Opus 4.8,這是其旗艦級公開模型的最新版本。此版本定價與前一版本相同,現已於所有平台上線。距離 Opus 4.7 發布僅隔 41 天,Anthropic 顯著加快了開發週期,遠快於近期 Sonnet 和 Haiku 版本所見的三個月及七個月間隔。此次快速更新很可能是為了回應 Opus 4.7 所獲得的冷淡反響,該版本曾讓許多使用者感到失望。與此同時,Ope
Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙
Google 週二宣布,Android 將推出「虛假來電偵測」功能,以防範利用人工智慧深度偽造技術進行的冒充詐騙。此功能將於本月透過「Phone by Google」在全球範圍內逐步推送至 Android 12 及以上版本的裝置,首先從 Pixel 裝置開始。隨著人們越來越不願接聽未知號碼的來電,詐騙者正改變策略,透過偽造可信賴的電話號碼,並利用 AI 深度偽造技術,讓聲音聽起來像是權威人士、家人
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr





首頁






