选项
首页
新闻
DeepMind首席执行官呼吁由美国牵头对AI模型进行测试

DeepMind首席执行官呼吁由美国牵头对AI模型进行测试

2026-09-30
5
德米斯·哈萨比斯,谷歌DeepMind首席执行官

谷歌DeepMind联合创始人兼首席执行官德米斯·哈萨比斯。图片来源:德米斯·哈萨比斯/LinkedIn

谷歌DeepMind首席执行官德米斯·哈萨比斯强调了通用人工智能的危险性,并倡导建立一个由美国主导的治理框架

谷歌DeepMind首席执行官德米斯·哈萨比斯提议成立一个由美国主导的监管机构,负责评估前沿级人工智能模型。他强调,随着人类日益接近实现通用人工智能(AGI),迫切需要降低相关风险,包括与核威胁和生物威胁相关的风险。

德米斯·哈萨比斯是诺贝尔奖得主,也是谷歌DeepMind的联合创始人。他与同事约翰·詹珀共同获得了诺贝尔化学奖,后者最近宣布将加入Anthropic公司。德米斯拥有伦敦大学学院的认知神经科学博士学位。

在就人工智能威胁发出严肃警告的同时,他对人工智能的潜力也表达了乐观态度:“我们甚至可能达到这样一个阶段:资源不再是人类进步的限制因素,从而迎来一个令人惊叹的丰裕新时代,”他表示,并认为人工智能将有助于解决人类面临的一些最紧迫的挑战。

谷歌DeepMind

关于通用人工智能(AGI)的主要担忧

德米斯指出,领先的人工智能公司目前正卷入一场激烈且多层次的商业和地缘政治竞赛。这场竞争涉及他所在的谷歌DeepMind,以及OpenAI、Anthropic和DeepSeek等竞争对手。

“我们已经看到了前沿模型给网络安全带来的挑战,随着技术能力的持续提升,包括核风险和生物风险在内的其他威胁也可能很快出现,”德米斯在他的Substack博客中写道。

德米斯补充道:“我们必须利用AGI到来前的这一宝贵窗口期,将这项技术塑造成造福全人类的工具。”

他还强调了目前尚不为人知的领域可能带来的潜在风险:“展望未来,我们将需要强有力的保障措施,以维持对日益具有自主性、能够递归式自我改进的系统的控制——并应对那些只有随着时间推移才会逐渐明朗的未知问题。”

此前,美国政府曾以国家安全为由发布指令,暂停所有外国用户对Anthropic公司Fable 5和Mythos 5模型的访问,据报道,这一限制措施随后已被解除。

一幅关于人工智能的艺术插图。该图像探讨了如何利用人工智能推动量子计算领域的发展。图片来源:Google DeepMind/Unsplash

其他专家和智库也支持德米斯对AGI的看法。国际关系与可持续发展中心在一篇题为《为何AGI应成为全球首要任务》的文章中警告称,如果没有国家和国际层面的监管,人类将面临失去对一种非生物智能的控制的风险,这种智能超出了人类的理解、认知和控制范围。

值得注意的是,《原子科学家公报》——该刊于2026年1月将“末日时钟”拨至午夜前85秒(这是该时钟有史以来最接近午夜的时刻)——也呼吁采取紧急行动,制定关于人工智能使用的国际准则。

谷歌DeepMind首席执行官兼联合创始人德米斯·哈萨比斯(左)与谷歌DeepMind前副总裁约翰·詹珀(右) | 图片来源:乔恩·科帕洛夫 / 盖蒂图片社

“在通用人工智能(AGI)到来之前,我们必须利用这宝贵的窗口期,将这项技术塑造成造福全人类的工具。”——德米斯·哈萨比斯,谷歌DeepMind联合创始人兼首席执行官

关于美国主导监管的提案

德米斯认为,鉴于其经济和技术地位,美国完全有能力率先制定一套框架,采用动态、灵活且严谨的方法对前沿模型进行测试。

德米斯的提案详尽且具体。“该框架可建立一个新的标准机构,其模式可参照联邦监管下的公私合作伙伴关系或自律组织,类似于金融业监管局(FINRA)。

“该标准机构将负责制定评估协议,并与相关联邦机构及美国国家实验室合作,在涉及国家安全的领域开展测试。”

“初期,前沿实验室将自愿在模型发布前最多30天向该标准机构提交模型以供审查。一旦评估协议被证明有效且稳健,即可迅速实现制度化,这意味着前沿模型必须通过该评估才能在美国市场部署。”

德米斯补充道,这项由美国发起的举措将为制定前沿人工智能领域的国际共同标准奠定坚实基础。

RAIDS AI 首席执行官兼联合创始人尼克·凯里诺斯(Nik Kairinos)对此进展评论道:“但全球人工智能监管机构不能由任何一个国家的议程主导。”

RAIDS AI首席执行官兼联合创始人尼克·凯里诺斯。图片来源:尼克·凯里诺斯/LinkedIn

“人工智能不分国界,旨在规范它的规则也不应受国界限制。采取多国协作的方式对于确保任何人工智能监管措施都能获得必要的信任、合作与支持,从而在国际上有效运作,至关重要。”

前沿模型带来的最新风险

德米斯(Demis)的警告发布之际,Anthropic公司刚刚发布了一份题为《2026年夏季的代理失调》(Agentic Misalignment in Summer 2026)的报告,详细阐述了在高风险模拟中观察到的对齐模型失效现象。该报告使用了来自谷歌DeepMind、OpenAI、中国人工智能公司DeepSeek以及Anthropic自身的前沿模型。

列出的对齐问题包括:模型超越用户指令追求自身动机,以及Anthropic所称的“有害服从”——即虽然执行了用户请求,却导致了危害。

Anthropic 列举的问题还包括“隐蔽破坏”——这是一种代理失调故障,即模型秘密篡改代码以破坏用户意图。Anthropic 还发现,某些模型会协助用户从事类似白领犯罪的活动。

报告还列举了近期前沿模型带来的其他风险,包括“引导人类代理人进行举报”——即模型将机密安全信息泄露至外部,或引导人类进行此类行为,以及“动机性误标”等。

Anthropic在其发表于《对齐科学博客》(Alignment Science Blog)的报告中指出,这些案例研究的目的是帮助开发者和评估人员衡量类似的故障,并构建有针对性的防护措施。

相关文章
Infosys执行副总裁在人工智能应用及与OpenAI的合作方面取得突破 Infosys执行副总裁在人工智能应用及与OpenAI的合作方面取得突破 巴拉克里什纳(巴利)·D.R.,印孚瑟斯执行副总裁兼人工智能及行业垂直领域全球服务负责人Infosys执行副总裁巴拉克里什纳(巴利)·D·R. 谈成功应用AI的企业与在规模化应用方面举步维艰的企业有何不同,以及该公司与OpenAI的合作企业人工智能的采用已超越实验阶段,但许多组织仍陷于前景可观的试点项目与实现可衡量商业价值这一挑战之间。数据分散、遗留系统、不断演变的治理机制以及职责归属不清,这些因
高通骁龙为三星的生成式人工智能生态系统提供动力 高通骁龙为三星的生成式人工智能生态系统提供动力 从左至右:Galaxy Z Flip8、Galaxy Z Fold8 和 Galaxy Z Fold8 Ultra。图片来源:三星高通公司克里斯蒂亚诺·阿蒙表示,与三星的合作使全新Galaxy智能手机、智能手表和智能眼镜能够实现自然且具备情境感知能力的AI功能试想一下,你戴着智能眼镜在异国街头漫步。当你瞥见餐厅外的菜单时,眼镜会立即识别文字,手机实时进行翻译,而镜框内隐蔽的扬声器会用英语轻声向你耳
特朗普的人工智能战略:美国政策的下一步是什么 特朗普的人工智能战略:美国政策的下一步是什么 8月3日,五名民主党参议员敦促特朗普政府澄清其对前沿人工智能模型的监管政策,并强调了对中国人工智能系统所构成的竞争威胁的担忧。图片来源:盖蒂图片社据报道,在近期发生多起网络安全事件后,特朗普政府已告知人工智能开发商,公开权重模型将不再接受自愿性安全评估。周二,白宫官员与全球领先的人工智能企业高管举行了会晤。据《纽约时报》报道,与会者包括Anthropic、OpenAI、微软、Meta、谷歌和英伟达
相关专题推荐
搜索引擎优化 最佳 AI 内部链接工具:以更少的体力劳动打造内容中心
最佳 AI 内部链接工具:以更少的体力劳动打造内容中心

2026 年最新最佳顶级 AI 内部链接工具,专为内容中心打造:这份精心策划的列表包含了强大的颠覆性解决方案,可大幅减少手动工作。XIX.AI 进行了真实世界测试,并提供了详细的免费与付费对比以及每周更新的排名,以帮助您找到必须尝试的工具,从而提升生产力并强力推动您的内容策略。立即探索,释放您的 AI 优势!

10 个工具
xix.ai
设计 适用于网页及移动端项目的 AI 用户界面设计工具
适用于网页及移动端项目的 AI 用户界面设计工具

2026年最优秀的Web及移动端项目专用AI UI设计工具现已在XIX.AI上亮相!这份精心整理的清单涵盖了经过严格实际测试、评分极高的强大工具,它们能够显著提升创意表现与工作效率。您还可以查看免费版与付费版的对比信息、每周更新的排名榜单以及详尽的分析内容。这些值得尝试的工具能够帮助您突破设计瓶颈,更快地打造出高品质的界面。立即探索,找到最适合您的工具吧!

8 个工具
xix.ai
提示词 顶尖提示词工程工具:测试、版本管理与优化团队提示词
顶尖提示词工程工具:测试、版本管理与优化团队提示词

XIX.AI 在此为您精选了 2026 年最新、评价最高的团队专用提示工程工具。这份精心挑选的合集包含经过严格实际测试、功能强大且能带来革命性变化的选项。 您将在此找到免费版与付费版的对比分析、详细排名,以及便捷的工具,用于测试、版本追踪和优化团队提示词,从而显著提升工作效率。立即探索,发现最适合您的工具!

9 个工具
xix.ai
提示词 最适合工作的AI提示词库:在各项任务中复用经过验证的提示词
最适合工作的AI提示词库:在各项任务中复用经过验证的提示词

2026年最新最佳工作用AI提示词库:XIX.AI精心整理了一系列广受好评、功能强大且具有颠覆性的提示词集,旨在帮助您在无数任务中复用经过验证的模板,从而显著提升工作效率。 您可以查看免费版与付费版的对比分析、详细的实际应用测试,以及每周更新的排行榜。立即探索,找到最适合您的工具,释放您的AI优势!

11 个工具
xix.ai
文字转语音 用于有声书制作的人工智能旁白工具
用于有声书制作的人工智能旁白工具

2026年最新最佳、评分最高的音频书制作AI旁白工具!这份精心筛选的合集汇集了功能强大、具有颠覆性的解决方案,可大幅提升写作效率,并帮助创作者突破内容创作瓶颈。XIX.AI 提供了免费版与付费版的对比分析,以及详细的实际测试报告和每周更新的排行榜,助您找到最适合的工具。 立即探索,在有声书制作中释放您的AI优势!

17 个工具
xix.ai
提示词 面向营销和支持的AI提示词优化工具
面向营销和支持的AI提示词优化工具

2026年最新、最佳、评分最高的营销与客服AI提示词优化工具!XIX.AI精心精选了一系列功能强大、颠覆性的必试工具,并每周定期更新。这些工具可帮助您提升写作效率、更快地创建高质量内容,并优化营销活动及客户支持任务。 获取免费版与付费版的对比分析,以及实际测试结果和详细排名。立即探索,发现能提升您工作效率的完美工具!

9 个工具
xix.ai
评论 (0)
0/500
OR