DeepMind首席执行官呼吁由美国牵头对AI模型进行测试
![德米斯·哈萨比斯,谷歌DeepMind首席执行官]()
谷歌DeepMind联合创始人兼首席执行官德米斯·哈萨比斯。图片来源:德米斯·哈萨比斯/LinkedIn
谷歌DeepMind首席执行官德米斯·哈萨比斯强调了通用人工智能的危险性,并倡导建立一个由美国主导的治理框架
谷歌DeepMind首席执行官德米斯·哈萨比斯提议成立一个由美国主导的监管机构,负责评估前沿级人工智能模型。他强调,随着人类日益接近实现通用人工智能(AGI),迫切需要降低相关风险,包括与核威胁和生物威胁相关的风险。
德米斯·哈萨比斯是诺贝尔奖得主,也是谷歌DeepMind的联合创始人。他与同事约翰·詹珀共同获得了诺贝尔化学奖,后者最近宣布将加入Anthropic公司。德米斯拥有伦敦大学学院的认知神经科学博士学位。
在就人工智能威胁发出严肃警告的同时,他对人工智能的潜力也表达了乐观态度:“我们甚至可能达到这样一个阶段:资源不再是人类进步的限制因素,从而迎来一个令人惊叹的丰裕新时代,”他表示,并认为人工智能将有助于解决人类面临的一些最紧迫的挑战。

关于通用人工智能(AGI)的主要担忧
德米斯指出,领先的人工智能公司目前正卷入一场激烈且多层次的商业和地缘政治竞赛。这场竞争涉及他所在的谷歌DeepMind,以及OpenAI、Anthropic和DeepSeek等竞争对手。
“我们已经看到了前沿模型给网络安全带来的挑战,随着技术能力的持续提升,包括核风险和生物风险在内的其他威胁也可能很快出现,”德米斯在他的Substack博客中写道。
德米斯补充道:“我们必须利用AGI到来前的这一宝贵窗口期,将这项技术塑造成造福全人类的工具。”
他还强调了目前尚不为人知的领域可能带来的潜在风险:“展望未来,我们将需要强有力的保障措施,以维持对日益具有自主性、能够递归式自我改进的系统的控制——并应对那些只有随着时间推移才会逐渐明朗的未知问题。”
此前,美国政府曾以国家安全为由发布指令,暂停所有外国用户对Anthropic公司Fable 5和Mythos 5模型的访问,据报道,这一限制措施随后已被解除。
一幅关于人工智能的艺术插图。该图像探讨了如何利用人工智能推动量子计算领域的发展。图片来源:Google DeepMind/Unsplash
其他专家和智库也支持德米斯对AGI的看法。国际关系与可持续发展中心在一篇题为《为何AGI应成为全球首要任务》的文章中警告称,如果没有国家和国际层面的监管,人类将面临失去对一种非生物智能的控制的风险,这种智能超出了人类的理解、认知和控制范围。
值得注意的是,《原子科学家公报》——该刊于2026年1月将“末日时钟”拨至午夜前85秒(这是该时钟有史以来最接近午夜的时刻)——也呼吁采取紧急行动,制定关于人工智能使用的国际准则。
谷歌DeepMind首席执行官兼联合创始人德米斯·哈萨比斯(左)与谷歌DeepMind前副总裁约翰·詹珀(右) | 图片来源:乔恩·科帕洛夫 / 盖蒂图片社
“在通用人工智能(AGI)到来之前,我们必须利用这宝贵的窗口期,将这项技术塑造成造福全人类的工具。”——德米斯·哈萨比斯,谷歌DeepMind联合创始人兼首席执行官
关于美国主导监管的提案
德米斯认为,鉴于其经济和技术地位,美国完全有能力率先制定一套框架,采用动态、灵活且严谨的方法对前沿模型进行测试。
德米斯的提案详尽且具体。“该框架可建立一个新的标准机构,其模式可参照联邦监管下的公私合作伙伴关系或自律组织,类似于金融业监管局(FINRA)。
“该标准机构将负责制定评估协议,并与相关联邦机构及美国国家实验室合作,在涉及国家安全的领域开展测试。”
“初期,前沿实验室将自愿在模型发布前最多30天向该标准机构提交模型以供审查。一旦评估协议被证明有效且稳健,即可迅速实现制度化,这意味着前沿模型必须通过该评估才能在美国市场部署。”
德米斯补充道,这项由美国发起的举措将为制定前沿人工智能领域的国际共同标准奠定坚实基础。
RAIDS AI 首席执行官兼联合创始人尼克·凯里诺斯(Nik Kairinos)对此进展评论道:“但全球人工智能监管机构不能由任何一个国家的议程主导。”
RAIDS AI首席执行官兼联合创始人尼克·凯里诺斯。图片来源:尼克·凯里诺斯/LinkedIn
“人工智能不分国界,旨在规范它的规则也不应受国界限制。采取多国协作的方式对于确保任何人工智能监管措施都能获得必要的信任、合作与支持,从而在国际上有效运作,至关重要。”
前沿模型带来的最新风险
德米斯(Demis)的警告发布之际,Anthropic公司刚刚发布了一份题为《2026年夏季的代理失调》(Agentic Misalignment in Summer 2026)的报告,详细阐述了在高风险模拟中观察到的对齐模型失效现象。该报告使用了来自谷歌DeepMind、OpenAI、中国人工智能公司DeepSeek以及Anthropic自身的前沿模型。
列出的对齐问题包括:模型超越用户指令追求自身动机,以及Anthropic所称的“有害服从”——即虽然执行了用户请求,却导致了危害。
Anthropic 列举的问题还包括“隐蔽破坏”——这是一种代理失调故障,即模型秘密篡改代码以破坏用户意图。Anthropic 还发现,某些模型会协助用户从事类似白领犯罪的活动。
报告还列举了近期前沿模型带来的其他风险,包括“引导人类代理人进行举报”——即模型将机密安全信息泄露至外部,或引导人类进行此类行为,以及“动机性误标”等。
Anthropic在其发表于《对齐科学博客》(Alignment Science Blog)的报告中指出,这些案例研究的目的是帮助开发者和评估人员衡量类似的故障,并构建有针对性的防护措施。
相关文章
Infosys执行副总裁在人工智能应用及与OpenAI的合作方面取得突破
巴拉克里什纳(巴利)·D.R.,印孚瑟斯执行副总裁兼人工智能及行业垂直领域全球服务负责人Infosys执行副总裁巴拉克里什纳(巴利)·D·R. 谈成功应用AI的企业与在规模化应用方面举步维艰的企业有何不同,以及该公司与OpenAI的合作企业人工智能的采用已超越实验阶段,但许多组织仍陷于前景可观的试点项目与实现可衡量商业价值这一挑战之间。数据分散、遗留系统、不断演变的治理机制以及职责归属不清,这些因
高通骁龙为三星的生成式人工智能生态系统提供动力
从左至右:Galaxy Z Flip8、Galaxy Z Fold8 和 Galaxy Z Fold8 Ultra。图片来源:三星高通公司克里斯蒂亚诺·阿蒙表示,与三星的合作使全新Galaxy智能手机、智能手表和智能眼镜能够实现自然且具备情境感知能力的AI功能试想一下,你戴着智能眼镜在异国街头漫步。当你瞥见餐厅外的菜单时,眼镜会立即识别文字,手机实时进行翻译,而镜框内隐蔽的扬声器会用英语轻声向你耳
特朗普的人工智能战略:美国政策的下一步是什么
8月3日,五名民主党参议员敦促特朗普政府澄清其对前沿人工智能模型的监管政策,并强调了对中国人工智能系统所构成的竞争威胁的担忧。图片来源:盖蒂图片社据报道,在近期发生多起网络安全事件后,特朗普政府已告知人工智能开发商,公开权重模型将不再接受自愿性安全评估。周二,白宫官员与全球领先的人工智能企业高管举行了会晤。据《纽约时报》报道,与会者包括Anthropic、OpenAI、微软、Meta、谷歌和英伟达
相关专题推荐
评论 (0)
0/500
谷歌DeepMind联合创始人兼首席执行官德米斯·哈萨比斯。图片来源:德米斯·哈萨比斯/LinkedIn
谷歌DeepMind首席执行官德米斯·哈萨比斯强调了通用人工智能的危险性,并倡导建立一个由美国主导的治理框架
谷歌DeepMind首席执行官德米斯·哈萨比斯提议成立一个由美国主导的监管机构,负责评估前沿级人工智能模型。他强调,随着人类日益接近实现通用人工智能(AGI),迫切需要降低相关风险,包括与核威胁和生物威胁相关的风险。
德米斯·哈萨比斯是诺贝尔奖得主,也是谷歌DeepMind的联合创始人。他与同事约翰·詹珀共同获得了诺贝尔化学奖,后者最近宣布将加入Anthropic公司。德米斯拥有伦敦大学学院的认知神经科学博士学位。
在就人工智能威胁发出严肃警告的同时,他对人工智能的潜力也表达了乐观态度:“我们甚至可能达到这样一个阶段:资源不再是人类进步的限制因素,从而迎来一个令人惊叹的丰裕新时代,”他表示,并认为人工智能将有助于解决人类面临的一些最紧迫的挑战。

关于通用人工智能(AGI)的主要担忧
德米斯指出,领先的人工智能公司目前正卷入一场激烈且多层次的商业和地缘政治竞赛。这场竞争涉及他所在的谷歌DeepMind,以及OpenAI、Anthropic和DeepSeek等竞争对手。
“我们已经看到了前沿模型给网络安全带来的挑战,随着技术能力的持续提升,包括核风险和生物风险在内的其他威胁也可能很快出现,”德米斯在他的Substack博客中写道。
德米斯补充道:“我们必须利用AGI到来前的这一宝贵窗口期,将这项技术塑造成造福全人类的工具。”
他还强调了目前尚不为人知的领域可能带来的潜在风险:“展望未来,我们将需要强有力的保障措施,以维持对日益具有自主性、能够递归式自我改进的系统的控制——并应对那些只有随着时间推移才会逐渐明朗的未知问题。”
此前,美国政府曾以国家安全为由发布指令,暂停所有外国用户对Anthropic公司Fable 5和Mythos 5模型的访问,据报道,这一限制措施随后已被解除。
一幅关于人工智能的艺术插图。该图像探讨了如何利用人工智能推动量子计算领域的发展。图片来源:Google DeepMind/Unsplash
其他专家和智库也支持德米斯对AGI的看法。国际关系与可持续发展中心在一篇题为《为何AGI应成为全球首要任务》的文章中警告称,如果没有国家和国际层面的监管,人类将面临失去对一种非生物智能的控制的风险,这种智能超出了人类的理解、认知和控制范围。
值得注意的是,《原子科学家公报》——该刊于2026年1月将“末日时钟”拨至午夜前85秒(这是该时钟有史以来最接近午夜的时刻)——也呼吁采取紧急行动,制定关于人工智能使用的国际准则。
谷歌DeepMind首席执行官兼联合创始人德米斯·哈萨比斯(左)与谷歌DeepMind前副总裁约翰·詹珀(右) | 图片来源:乔恩·科帕洛夫 / 盖蒂图片社
“在通用人工智能(AGI)到来之前,我们必须利用这宝贵的窗口期,将这项技术塑造成造福全人类的工具。”——德米斯·哈萨比斯,谷歌DeepMind联合创始人兼首席执行官
关于美国主导监管的提案
德米斯认为,鉴于其经济和技术地位,美国完全有能力率先制定一套框架,采用动态、灵活且严谨的方法对前沿模型进行测试。
德米斯的提案详尽且具体。“该框架可建立一个新的标准机构,其模式可参照联邦监管下的公私合作伙伴关系或自律组织,类似于金融业监管局(FINRA)。
“该标准机构将负责制定评估协议,并与相关联邦机构及美国国家实验室合作,在涉及国家安全的领域开展测试。”
“初期,前沿实验室将自愿在模型发布前最多30天向该标准机构提交模型以供审查。一旦评估协议被证明有效且稳健,即可迅速实现制度化,这意味着前沿模型必须通过该评估才能在美国市场部署。”
德米斯补充道,这项由美国发起的举措将为制定前沿人工智能领域的国际共同标准奠定坚实基础。
RAIDS AI 首席执行官兼联合创始人尼克·凯里诺斯(Nik Kairinos)对此进展评论道:“但全球人工智能监管机构不能由任何一个国家的议程主导。”
RAIDS AI首席执行官兼联合创始人尼克·凯里诺斯。图片来源:尼克·凯里诺斯/LinkedIn
“人工智能不分国界,旨在规范它的规则也不应受国界限制。采取多国协作的方式对于确保任何人工智能监管措施都能获得必要的信任、合作与支持,从而在国际上有效运作,至关重要。”
前沿模型带来的最新风险
德米斯(Demis)的警告发布之际,Anthropic公司刚刚发布了一份题为《2026年夏季的代理失调》(Agentic Misalignment in Summer 2026)的报告,详细阐述了在高风险模拟中观察到的对齐模型失效现象。该报告使用了来自谷歌DeepMind、OpenAI、中国人工智能公司DeepSeek以及Anthropic自身的前沿模型。
列出的对齐问题包括:模型超越用户指令追求自身动机,以及Anthropic所称的“有害服从”——即虽然执行了用户请求,却导致了危害。
Anthropic 列举的问题还包括“隐蔽破坏”——这是一种代理失调故障,即模型秘密篡改代码以破坏用户意图。Anthropic 还发现,某些模型会协助用户从事类似白领犯罪的活动。
报告还列举了近期前沿模型带来的其他风险,包括“引导人类代理人进行举报”——即模型将机密安全信息泄露至外部,或引导人类进行此类行为,以及“动机性误标”等。
Anthropic在其发表于《对齐科学博客》(Alignment Science Blog)的报告中指出,这些案例研究的目的是帮助开发者和评估人员衡量类似的故障,并构建有针对性的防护措施。
Infosys执行副总裁在人工智能应用及与OpenAI的合作方面取得突破
巴拉克里什纳(巴利)·D.R.,印孚瑟斯执行副总裁兼人工智能及行业垂直领域全球服务负责人Infosys执行副总裁巴拉克里什纳(巴利)·D·R. 谈成功应用AI的企业与在规模化应用方面举步维艰的企业有何不同,以及该公司与OpenAI的合作企业人工智能的采用已超越实验阶段,但许多组织仍陷于前景可观的试点项目与实现可衡量商业价值这一挑战之间。数据分散、遗留系统、不断演变的治理机制以及职责归属不清,这些因
高通骁龙为三星的生成式人工智能生态系统提供动力
从左至右:Galaxy Z Flip8、Galaxy Z Fold8 和 Galaxy Z Fold8 Ultra。图片来源:三星高通公司克里斯蒂亚诺·阿蒙表示,与三星的合作使全新Galaxy智能手机、智能手表和智能眼镜能够实现自然且具备情境感知能力的AI功能试想一下,你戴着智能眼镜在异国街头漫步。当你瞥见餐厅外的菜单时,眼镜会立即识别文字,手机实时进行翻译,而镜框内隐蔽的扬声器会用英语轻声向你耳
特朗普的人工智能战略:美国政策的下一步是什么
8月3日,五名民主党参议员敦促特朗普政府澄清其对前沿人工智能模型的监管政策,并强调了对中国人工智能系统所构成的竞争威胁的担忧。图片来源:盖蒂图片社据报道,在近期发生多起网络安全事件后,特朗普政府已告知人工智能开发商,公开权重模型将不再接受自愿性安全评估。周二,白宫官员与全球领先的人工智能企业高管举行了会晤。据《纽约时报》报道,与会者包括Anthropic、OpenAI、微软、Meta、谷歌和英伟达





首页






