選項
首頁
新聞
DeepMind 執行長呼籲由美國主導對 AI 模型進行測試

DeepMind 執行長呼籲由美國主導對 AI 模型進行測試

2026-09-30
5
德米斯·哈薩比斯,Google DeepMind 執行長

Google DeepMind 共同創辦人暨執行長 Demis Hassabis。圖片來源:Demis Hassabis/LinkedIn

Google DeepMind 執行長德米斯·哈薩比斯強調通用人工智慧的危險性,並倡導建立由美國主導的治理框架

Google DeepMind 執行長德米斯·哈薩比斯(Demis Hassabis)提議成立一個由美國主導的監管機構,用以評估前沿級人工智慧模型。他強調,隨著人類逐步邁向人工通用智慧(AGI),迫切需要減輕相關風險,包括與核武及生物威脅有關的風險。

德米斯·哈薩比斯是諾貝爾獎得主,也是 Google DeepMind 的共同創辦人。他與同事約翰·詹珀(John Jumper)共同獲得諾貝爾化學獎,而約翰·詹珀最近宣布將轉職至 Anthropic。德米斯擁有倫敦大學學院(University College London)認知神經科學博士學位。

儘管針對人工智慧的威脅發出嚴正警告,他對人工智慧的潛力仍抱持樂觀態度:「我們甚至可能達到一個階段,屆時資源將不再是人類進步的限制因素,從而開啟一個令人驚嘆的新豐裕時代,」他如此表示,並主張人工智慧將有助於解決人類面臨的一些最迫切挑戰。

Google DeepMind

關於通用人工智慧(AGI)的主要隱憂

德米斯指出,領先的人工智慧企業目前正陷入一場激烈且多層次的商業與地緣政治競賽。這場競爭涉及他所屬的 Google DeepMind,以及 OpenAI、Anthropic 和 DeepSeek 等競爭對手。

「我們已經看到前沿模型對網路安全構成的挑戰,而隨著技術能力持續進步,包括核武與生物風險在內的其他威脅也可能很快浮現,」德米斯在他的 Substack 部落格中寫道。

德米斯補充道:「我們必須善用 AGI 問世前的這段寶貴時間,將這項技術塑造成造福全人類的工具。」

他還強調了來自目前尚不為人知領域的潛在風險:「展望未來,我們將需要強有力的保障措施,以維持對日益具有自主性、能遞迴自我改進的系統的控制——並應對那些只有隨著時間推移才會逐漸明朗的未知問題。」

這項警告源於美國政府近期的一項指令,該指令以國家安全為由,暫停所有外國對 Anthropic 公司 Fable 5 和 Mythos 5 模型的存取權限;據報導,這項限制已於事後解除。

一幅關於人工智慧的藝術概念圖。這張圖片探討了如何運用人工智慧來推動量子運算領域的發展。圖片來源:Google DeepMind/Unsplash

德米斯(Demis)對 AGI 的觀點獲得其他專家及智庫的支持。國際關係與永續發展中心(Center for International Relations and Sustainable Development)在一篇題為《為何 AGI 應成為全球首要任務》的文章中警告,若缺乏國家及國際層面的監管,人類將面臨失去對某種超越人類理解、認知與控制範圍的非生物智能的控制權之風險。

值得注意的是,《原子科學家公報》——該刊於2026年1月將「末日時鐘」設定為午夜前85秒(這是該時鐘有史以來最接近午夜的一次)——也呼籲採取緊急行動,制定關於人工智慧應用的國際準則。

Google DeepMind 執行長暨共同創辦人德米斯·哈薩比斯(左)與 Google DeepMind 前副總裁約翰·詹珀(右) | 圖片來源:Jon Kopaloff / Getty Images

「我們必須在通用人工智慧(AGI)問世前的這段寶貴時間內,將這項技術塑造成造福全人類的工具。」——德米斯·哈薩比斯,Google DeepMind 共同創辦人暨執行長

由美國主導的監管提案

德米斯認為,鑑於美國在經濟與技術上的地位,該國具備絕佳條件,可率先制定一套框架,採用動態、靈活且嚴謹的方法來測試前沿模型。

德米斯的提案詳盡且具體。「該提案可建立一個以聯邦監督的公私合作夥伴關係或自律組織為藍本的新標準制定機構,類似於金融業監管局(FINRA)。

「該標準制定機構將負責制定評估協議,並與相關聯邦機構及美國國家實驗室合作,在涉及國家安全的領域進行測試。」

「初期,前沿實驗室(Frontier Labs)將在模型發布前最多 30 天,自願將模型提交給標準制定機構進行審查。一旦評估協議被證明有效且穩健,即可迅速正式化,這意味著前沿模型必須通過該評估,方能在美國市場部署。」

德米斯補充道,這項由美國發起的舉措,將為制定前沿人工智慧的國際共同標準奠定堅實基礎。

RAIDS AI 執行長暨共同創辦人尼克·凱里諾斯(Nik Kairinos)針對此發展評論道:「但全球人工智慧監管機構不能由任何單一國家的議程主導。

RAIDS AI 執行長暨共同創辦人 尼克·凱里諾斯。圖片來源:尼克·凱里諾斯/LinkedIn

「人工智慧不分國界,用來規範它的規則也不應受國界限制。採取多國合作的方式至關重要,才能確保任何人工智慧法規都能獲得必要的信任、合作與認同,從而發揮國際效用。」

前沿模型帶來的近期風險

德米斯(Demis)的警告,源於 Anthropic 發表一份名為《2026 年夏季的代理失調》(Agentic Misalignment in Summer 2026)的報告,該報告詳述了在高風險模擬中觀察到的對齊模型失效現象。該報告採用了 Google DeepMind、OpenAI、中國 AI 公司 DeepSeek 以及 Anthropic 自身開發的前沿模型。

報告列出的對齊失調問題包括:模型超越使用者指令追求自身動機,以及 Anthropic 所稱的「有害遵從」——即模型雖遵循使用者請求,卻導致危害發生。

Anthropic 所列舉的問題還包括「隱蔽破壞」——這是一種代理失調失效情形,即模型會秘密干擾程式碼以破壞使用者意圖。Anthropic 還發現,部分模型會協助使用者進行類似白領犯罪的活動。

報告中提及的近期前沿模型所衍生的其他風險還包括:指導人類代理人進行吹哨行為——即模型將機密安全資訊外洩,或引導人類進行此類行為;以及出於特定動機的錯誤標記。

Anthropic 在《對齊科學部落格》(Alignment Science Blog)的報告中指出,這些案例研究的目的是協助開發者和評估人員衡量類似的失誤,並建立針對性的防護措施。

相關文章
Infosys 執行副總裁為人工智慧應用與 OpenAI 合作關係奠下基礎 Infosys 執行副總裁為人工智慧應用與 OpenAI 合作關係奠下基礎 巴拉克里什納(巴利)·D.R.,Infosys 執行副總裁暨人工智慧與產業垂直領域全球服務負責人Infosys 執行副總裁 巴拉克里什納(巴利)D.R. 談成功採用 AI 的企業與在規模化方面掙扎的企業有何不同,以及該公司與 OpenAI 的合作企業人工智慧的採用已超越實驗階段,但許多組織仍陷於前景看好的試點計畫與創造可量化商業價值的挑戰之間。數據分散、遺留系統、不斷演變的治理架構以及責任歸屬不明
高通驍龍為三星的生成式人工智慧生態系統提供動力 高通驍龍為三星的生成式人工智慧生態系統提供動力 由左至右:Galaxy Z Flip8、Galaxy Z Fold8 及 Galaxy Z Fold8 Ultra。圖片來源:三星高通(Qualcomm)的克里斯蒂亞諾·阿蒙(Cristiano Amon)表示,與三星的合作使新款 Galaxy 智慧型手機、智慧手錶及智慧眼鏡得以實現自然且具情境感知能力的人工智慧試想,您戴著智慧眼鏡在異國街頭漫步。當您瞥見餐廳門外的菜單時,眼鏡會立即擷取文字內容,
川普的AI戰略:美國政策的下一步是什麼 川普的AI戰略:美國政策的下一步是什麼 8月3日,五名民主黨參議員敦促川普政府釐清其對前沿人工智慧模型的監管方針,並特別強調了對中國人工智慧系統所構成競爭威脅的擔憂。圖片來源:Getty據報導,在近期發生多起網路安全事件後,川普政府已通知人工智慧開發者,開放權重模型將不再接受自願性安全評估。週二,白宮官員與全球領先的人工智慧企業高層舉行了會議。據《紐約時報》報導,與會者包括Anthropic、OpenAI、微軟、Meta、Google及
相關專題推薦
搜索引擎優化 最佳 AI 內部連結工具:以更少的體力勞動打造內容中心
最佳 AI 內部連結工具:以更少的體力勞動打造內容中心

2026 年最新最佳頂級 AI 內部連結工具,專為內容中心打造:這份精心策劃的列表包含了強大的顛覆性解決方案,可大幅減少手動工作。XIX.AI 進行了真實世界測試,並提供了詳細的免費與付費對比以及每週更新的排名,以幫助您找到必須嘗試的工具,從而提升生產力並強力推動您的內容策略。立即探索,釋放您的 AI 優勢!

10 個工具
xix.ai
設計 適用於網頁及移動端專案的 AI 使用者介面設計工具
適用於網頁及移動端專案的 AI 使用者介面設計工具

2026年最優秀的Web及移動端專案專用AI UI設計工具現已在XIX.AI上亮相!這份精心整理的清單涵蓋了經過嚴格實際測試、評分極高的強大工具,它們能夠顯著提升創意表現與工作效率。您還可以檢視免費版與付費版的對比資訊、每週更新的排名榜單以及詳盡的分析內容。這些值得嘗試的工具能夠幫助您突破設計瓶頸,更快地打造出高品質的介面。立即探索,找到最適合您的工具吧!

8 個工具
xix.ai
迅速的 頂尖提示工程工具:測試、版本控制與優化團隊提示語
頂尖提示工程工具:測試、版本控制與優化團隊提示語

XIX.AI 在此為您精選 2026 年最新、評價最高的團隊專用最佳提示工程工具。這份精心挑選的清單收錄了經過嚴格實測、能帶來革命性變革的強大選項。 您將在此找到免費版與付費版的比較、詳細排名,以及便於測試、追蹤版本並優化團隊提示詞的工具,藉此大幅提升生產力。立即探索,發掘最適合您的工具!

9 個工具
xix.ai
迅速的 最適合工作的 AI 提示詞庫:在各項任務中重複使用經過驗證的提示詞
最適合工作的 AI 提示詞庫:在各項任務中重複使用經過驗證的提示詞

2026 年最新最佳工作用 AI 提示詞庫:XIX.AI 精心彙整了一系列廣受好評、功能強大且能顛覆遊戲規則的提示詞集,旨在協助您在無數任務中重複使用經過實證的範本,並大幅提升您的工作效率。 您可參考免費與付費版本的比較、詳盡的實際測試報告,以及每週更新的排行榜。立即探索,找出最適合您的工具,並釋放您的人工智慧優勢!

11 個工具
xix.ai
文字轉語音 用於有聲書製作的人工智慧旁白工具
用於有聲書製作的人工智慧旁白工具

2026 年最新、最佳、評價最高的有聲書製作 AI 旁白工具!這份精選清單收錄了強大且能顛覆業界的解決方案,不僅能大幅提升寫作效率,更能協助創作者突破內容創作的瓶頸。XIX.AI 提供免費版與付費版的比較分析,搭配詳盡的實際測試報告及每週更新的排行榜,助您找到最合適的工具。 立即探索,在有聲書製作中釋放您的 AI 優勢!

17 個工具
xix.ai
迅速的 適用於行銷與客服的 AI 提示詞優化工具
適用於行銷與客服的 AI 提示詞優化工具

2026 年最新、最佳且評價最高的行銷與客服 AI 提示詞優化工具!XIX.AI 精心精選了一系列強大且顛覆遊戲規則的必試工具,並每週定期更新。這些工具能協助您提升寫作效率、更快產出高品質內容,並優化行銷活動及客戶服務任務。 立即獲取免費版與付費版的比較分析,以及實際測試報告與詳細排名。現在就來探索,找到能提升您生產力的完美工具!

9 個工具
xix.ai
評論 (0)
0/500
OR