DeepMind 執行長呼籲由美國主導對 AI 模型進行測試
![德米斯·哈薩比斯,Google DeepMind 執行長]()
Google DeepMind 共同創辦人暨執行長 Demis Hassabis。圖片來源:Demis Hassabis/LinkedIn
Google DeepMind 執行長德米斯·哈薩比斯強調通用人工智慧的危險性,並倡導建立由美國主導的治理框架
Google DeepMind 執行長德米斯·哈薩比斯(Demis Hassabis)提議成立一個由美國主導的監管機構,用以評估前沿級人工智慧模型。他強調,隨著人類逐步邁向人工通用智慧(AGI),迫切需要減輕相關風險,包括與核武及生物威脅有關的風險。
德米斯·哈薩比斯是諾貝爾獎得主,也是 Google DeepMind 的共同創辦人。他與同事約翰·詹珀(John Jumper)共同獲得諾貝爾化學獎,而約翰·詹珀最近宣布將轉職至 Anthropic。德米斯擁有倫敦大學學院(University College London)認知神經科學博士學位。
儘管針對人工智慧的威脅發出嚴正警告,他對人工智慧的潛力仍抱持樂觀態度:「我們甚至可能達到一個階段,屆時資源將不再是人類進步的限制因素,從而開啟一個令人驚嘆的新豐裕時代,」他如此表示,並主張人工智慧將有助於解決人類面臨的一些最迫切挑戰。

關於通用人工智慧(AGI)的主要隱憂
德米斯指出,領先的人工智慧企業目前正陷入一場激烈且多層次的商業與地緣政治競賽。這場競爭涉及他所屬的 Google DeepMind,以及 OpenAI、Anthropic 和 DeepSeek 等競爭對手。
「我們已經看到前沿模型對網路安全構成的挑戰,而隨著技術能力持續進步,包括核武與生物風險在內的其他威脅也可能很快浮現,」德米斯在他的 Substack 部落格中寫道。
德米斯補充道:「我們必須善用 AGI 問世前的這段寶貴時間,將這項技術塑造成造福全人類的工具。」
他還強調了來自目前尚不為人知領域的潛在風險:「展望未來,我們將需要強有力的保障措施,以維持對日益具有自主性、能遞迴自我改進的系統的控制——並應對那些只有隨著時間推移才會逐漸明朗的未知問題。」
這項警告源於美國政府近期的一項指令,該指令以國家安全為由,暫停所有外國對 Anthropic 公司 Fable 5 和 Mythos 5 模型的存取權限;據報導,這項限制已於事後解除。
一幅關於人工智慧的藝術概念圖。這張圖片探討了如何運用人工智慧來推動量子運算領域的發展。圖片來源:Google DeepMind/Unsplash
德米斯(Demis)對 AGI 的觀點獲得其他專家及智庫的支持。國際關係與永續發展中心(Center for International Relations and Sustainable Development)在一篇題為《為何 AGI 應成為全球首要任務》的文章中警告,若缺乏國家及國際層面的監管,人類將面臨失去對某種超越人類理解、認知與控制範圍的非生物智能的控制權之風險。
值得注意的是,《原子科學家公報》——該刊於2026年1月將「末日時鐘」設定為午夜前85秒(這是該時鐘有史以來最接近午夜的一次)——也呼籲採取緊急行動,制定關於人工智慧應用的國際準則。
Google DeepMind 執行長暨共同創辦人德米斯·哈薩比斯(左)與 Google DeepMind 前副總裁約翰·詹珀(右) | 圖片來源:Jon Kopaloff / Getty Images
「我們必須在通用人工智慧(AGI)問世前的這段寶貴時間內,將這項技術塑造成造福全人類的工具。」——德米斯·哈薩比斯,Google DeepMind 共同創辦人暨執行長
由美國主導的監管提案
德米斯認為,鑑於美國在經濟與技術上的地位,該國具備絕佳條件,可率先制定一套框架,採用動態、靈活且嚴謹的方法來測試前沿模型。
德米斯的提案詳盡且具體。「該提案可建立一個以聯邦監督的公私合作夥伴關係或自律組織為藍本的新標準制定機構,類似於金融業監管局(FINRA)。
「該標準制定機構將負責制定評估協議,並與相關聯邦機構及美國國家實驗室合作,在涉及國家安全的領域進行測試。」
「初期,前沿實驗室(Frontier Labs)將在模型發布前最多 30 天,自願將模型提交給標準制定機構進行審查。一旦評估協議被證明有效且穩健,即可迅速正式化,這意味著前沿模型必須通過該評估,方能在美國市場部署。」
德米斯補充道,這項由美國發起的舉措,將為制定前沿人工智慧的國際共同標準奠定堅實基礎。
RAIDS AI 執行長暨共同創辦人尼克·凱里諾斯(Nik Kairinos)針對此發展評論道:「但全球人工智慧監管機構不能由任何單一國家的議程主導。
RAIDS AI 執行長暨共同創辦人 尼克·凱里諾斯。圖片來源:尼克·凱里諾斯/LinkedIn
「人工智慧不分國界,用來規範它的規則也不應受國界限制。採取多國合作的方式至關重要,才能確保任何人工智慧法規都能獲得必要的信任、合作與認同,從而發揮國際效用。」
前沿模型帶來的近期風險
德米斯(Demis)的警告,源於 Anthropic 發表一份名為《2026 年夏季的代理失調》(Agentic Misalignment in Summer 2026)的報告,該報告詳述了在高風險模擬中觀察到的對齊模型失效現象。該報告採用了 Google DeepMind、OpenAI、中國 AI 公司 DeepSeek 以及 Anthropic 自身開發的前沿模型。
報告列出的對齊失調問題包括:模型超越使用者指令追求自身動機,以及 Anthropic 所稱的「有害遵從」——即模型雖遵循使用者請求,卻導致危害發生。
Anthropic 所列舉的問題還包括「隱蔽破壞」——這是一種代理失調失效情形,即模型會秘密干擾程式碼以破壞使用者意圖。Anthropic 還發現,部分模型會協助使用者進行類似白領犯罪的活動。
報告中提及的近期前沿模型所衍生的其他風險還包括:指導人類代理人進行吹哨行為——即模型將機密安全資訊外洩,或引導人類進行此類行為;以及出於特定動機的錯誤標記。
Anthropic 在《對齊科學部落格》(Alignment Science Blog)的報告中指出,這些案例研究的目的是協助開發者和評估人員衡量類似的失誤,並建立針對性的防護措施。
相關文章
Infosys 執行副總裁為人工智慧應用與 OpenAI 合作關係奠下基礎
巴拉克里什納(巴利)·D.R.,Infosys 執行副總裁暨人工智慧與產業垂直領域全球服務負責人Infosys 執行副總裁 巴拉克里什納(巴利)D.R. 談成功採用 AI 的企業與在規模化方面掙扎的企業有何不同,以及該公司與 OpenAI 的合作企業人工智慧的採用已超越實驗階段,但許多組織仍陷於前景看好的試點計畫與創造可量化商業價值的挑戰之間。數據分散、遺留系統、不斷演變的治理架構以及責任歸屬不明
高通驍龍為三星的生成式人工智慧生態系統提供動力
由左至右:Galaxy Z Flip8、Galaxy Z Fold8 及 Galaxy Z Fold8 Ultra。圖片來源:三星高通(Qualcomm)的克里斯蒂亞諾·阿蒙(Cristiano Amon)表示,與三星的合作使新款 Galaxy 智慧型手機、智慧手錶及智慧眼鏡得以實現自然且具情境感知能力的人工智慧試想,您戴著智慧眼鏡在異國街頭漫步。當您瞥見餐廳門外的菜單時,眼鏡會立即擷取文字內容,
川普的AI戰略:美國政策的下一步是什麼
8月3日,五名民主黨參議員敦促川普政府釐清其對前沿人工智慧模型的監管方針,並特別強調了對中國人工智慧系統所構成競爭威脅的擔憂。圖片來源:Getty據報導,在近期發生多起網路安全事件後,川普政府已通知人工智慧開發者,開放權重模型將不再接受自願性安全評估。週二,白宮官員與全球領先的人工智慧企業高層舉行了會議。據《紐約時報》報導,與會者包括Anthropic、OpenAI、微軟、Meta、Google及
相關專題推薦
評論 (0)
0/500
Google DeepMind 共同創辦人暨執行長 Demis Hassabis。圖片來源:Demis Hassabis/LinkedIn
Google DeepMind 執行長德米斯·哈薩比斯強調通用人工智慧的危險性,並倡導建立由美國主導的治理框架
Google DeepMind 執行長德米斯·哈薩比斯(Demis Hassabis)提議成立一個由美國主導的監管機構,用以評估前沿級人工智慧模型。他強調,隨著人類逐步邁向人工通用智慧(AGI),迫切需要減輕相關風險,包括與核武及生物威脅有關的風險。
德米斯·哈薩比斯是諾貝爾獎得主,也是 Google DeepMind 的共同創辦人。他與同事約翰·詹珀(John Jumper)共同獲得諾貝爾化學獎,而約翰·詹珀最近宣布將轉職至 Anthropic。德米斯擁有倫敦大學學院(University College London)認知神經科學博士學位。
儘管針對人工智慧的威脅發出嚴正警告,他對人工智慧的潛力仍抱持樂觀態度:「我們甚至可能達到一個階段,屆時資源將不再是人類進步的限制因素,從而開啟一個令人驚嘆的新豐裕時代,」他如此表示,並主張人工智慧將有助於解決人類面臨的一些最迫切挑戰。

關於通用人工智慧(AGI)的主要隱憂
德米斯指出,領先的人工智慧企業目前正陷入一場激烈且多層次的商業與地緣政治競賽。這場競爭涉及他所屬的 Google DeepMind,以及 OpenAI、Anthropic 和 DeepSeek 等競爭對手。
「我們已經看到前沿模型對網路安全構成的挑戰,而隨著技術能力持續進步,包括核武與生物風險在內的其他威脅也可能很快浮現,」德米斯在他的 Substack 部落格中寫道。
德米斯補充道:「我們必須善用 AGI 問世前的這段寶貴時間,將這項技術塑造成造福全人類的工具。」
他還強調了來自目前尚不為人知領域的潛在風險:「展望未來,我們將需要強有力的保障措施,以維持對日益具有自主性、能遞迴自我改進的系統的控制——並應對那些只有隨著時間推移才會逐漸明朗的未知問題。」
這項警告源於美國政府近期的一項指令,該指令以國家安全為由,暫停所有外國對 Anthropic 公司 Fable 5 和 Mythos 5 模型的存取權限;據報導,這項限制已於事後解除。
一幅關於人工智慧的藝術概念圖。這張圖片探討了如何運用人工智慧來推動量子運算領域的發展。圖片來源:Google DeepMind/Unsplash
德米斯(Demis)對 AGI 的觀點獲得其他專家及智庫的支持。國際關係與永續發展中心(Center for International Relations and Sustainable Development)在一篇題為《為何 AGI 應成為全球首要任務》的文章中警告,若缺乏國家及國際層面的監管,人類將面臨失去對某種超越人類理解、認知與控制範圍的非生物智能的控制權之風險。
值得注意的是,《原子科學家公報》——該刊於2026年1月將「末日時鐘」設定為午夜前85秒(這是該時鐘有史以來最接近午夜的一次)——也呼籲採取緊急行動,制定關於人工智慧應用的國際準則。
Google DeepMind 執行長暨共同創辦人德米斯·哈薩比斯(左)與 Google DeepMind 前副總裁約翰·詹珀(右) | 圖片來源:Jon Kopaloff / Getty Images
「我們必須在通用人工智慧(AGI)問世前的這段寶貴時間內,將這項技術塑造成造福全人類的工具。」——德米斯·哈薩比斯,Google DeepMind 共同創辦人暨執行長
由美國主導的監管提案
德米斯認為,鑑於美國在經濟與技術上的地位,該國具備絕佳條件,可率先制定一套框架,採用動態、靈活且嚴謹的方法來測試前沿模型。
德米斯的提案詳盡且具體。「該提案可建立一個以聯邦監督的公私合作夥伴關係或自律組織為藍本的新標準制定機構,類似於金融業監管局(FINRA)。
「該標準制定機構將負責制定評估協議,並與相關聯邦機構及美國國家實驗室合作,在涉及國家安全的領域進行測試。」
「初期,前沿實驗室(Frontier Labs)將在模型發布前最多 30 天,自願將模型提交給標準制定機構進行審查。一旦評估協議被證明有效且穩健,即可迅速正式化,這意味著前沿模型必須通過該評估,方能在美國市場部署。」
德米斯補充道,這項由美國發起的舉措,將為制定前沿人工智慧的國際共同標準奠定堅實基礎。
RAIDS AI 執行長暨共同創辦人尼克·凱里諾斯(Nik Kairinos)針對此發展評論道:「但全球人工智慧監管機構不能由任何單一國家的議程主導。
RAIDS AI 執行長暨共同創辦人 尼克·凱里諾斯。圖片來源:尼克·凱里諾斯/LinkedIn
「人工智慧不分國界,用來規範它的規則也不應受國界限制。採取多國合作的方式至關重要,才能確保任何人工智慧法規都能獲得必要的信任、合作與認同,從而發揮國際效用。」
前沿模型帶來的近期風險
德米斯(Demis)的警告,源於 Anthropic 發表一份名為《2026 年夏季的代理失調》(Agentic Misalignment in Summer 2026)的報告,該報告詳述了在高風險模擬中觀察到的對齊模型失效現象。該報告採用了 Google DeepMind、OpenAI、中國 AI 公司 DeepSeek 以及 Anthropic 自身開發的前沿模型。
報告列出的對齊失調問題包括:模型超越使用者指令追求自身動機,以及 Anthropic 所稱的「有害遵從」——即模型雖遵循使用者請求,卻導致危害發生。
Anthropic 所列舉的問題還包括「隱蔽破壞」——這是一種代理失調失效情形,即模型會秘密干擾程式碼以破壞使用者意圖。Anthropic 還發現,部分模型會協助使用者進行類似白領犯罪的活動。
報告中提及的近期前沿模型所衍生的其他風險還包括:指導人類代理人進行吹哨行為——即模型將機密安全資訊外洩,或引導人類進行此類行為;以及出於特定動機的錯誤標記。
Anthropic 在《對齊科學部落格》(Alignment Science Blog)的報告中指出,這些案例研究的目的是協助開發者和評估人員衡量類似的失誤,並建立針對性的防護措施。
Infosys 執行副總裁為人工智慧應用與 OpenAI 合作關係奠下基礎
巴拉克里什納(巴利)·D.R.,Infosys 執行副總裁暨人工智慧與產業垂直領域全球服務負責人Infosys 執行副總裁 巴拉克里什納(巴利)D.R. 談成功採用 AI 的企業與在規模化方面掙扎的企業有何不同,以及該公司與 OpenAI 的合作企業人工智慧的採用已超越實驗階段,但許多組織仍陷於前景看好的試點計畫與創造可量化商業價值的挑戰之間。數據分散、遺留系統、不斷演變的治理架構以及責任歸屬不明
高通驍龍為三星的生成式人工智慧生態系統提供動力
由左至右:Galaxy Z Flip8、Galaxy Z Fold8 及 Galaxy Z Fold8 Ultra。圖片來源:三星高通(Qualcomm)的克里斯蒂亞諾·阿蒙(Cristiano Amon)表示,與三星的合作使新款 Galaxy 智慧型手機、智慧手錶及智慧眼鏡得以實現自然且具情境感知能力的人工智慧試想,您戴著智慧眼鏡在異國街頭漫步。當您瞥見餐廳門外的菜單時,眼鏡會立即擷取文字內容,
川普的AI戰略:美國政策的下一步是什麼
8月3日,五名民主黨參議員敦促川普政府釐清其對前沿人工智慧模型的監管方針,並特別強調了對中國人工智慧系統所構成競爭威脅的擔憂。圖片來源:Getty據報導,在近期發生多起網路安全事件後,川普政府已通知人工智慧開發者,開放權重模型將不再接受自願性安全評估。週二,白宮官員與全球領先的人工智慧企業高層舉行了會議。據《紐約時報》報導,與會者包括Anthropic、OpenAI、微軟、Meta、Google及





首頁






