Google DeepMind 成立研究所以扩大关于通用人工智能(AGI)的讨论

Google和Google DeepMind于周三成立了DeepMind研究所,以促进关于通用人工智能(AGI)的对话。该研究所由DeepMind联合创始人Shane Legg、Google高管James Manyika以及Google DeepMind主席Demis Hassabis领导,其中Legg担任执行编辑。
这一新举措旨在突出Google、DeepMind以及全球研究社区内部关于AGI的多样化观点。公告指出,参与者“可能并不总是达成一致”,并且随着这一快速演进的领域出现新数据,他们可能会修正自己的立场。
首批收录的四篇论文探讨了关键问题:管理潜在AGI颠覆的经济策略、保持人类可读的模型推理、人类繁荣的原则,以及评估前沿AI模型的框架。
DeepMind安全研究人员Rohin Shah和Anca Dragan在一篇论文中指出,AI系统透明度的下降——即逐步检查推理过程的能力——并非不可避免。随着新架构使监控变得复杂,他们建议开发人员和监管机构必须直接解决安全权衡问题。这可能涉及限制“不透明的串行深度”,或要求证明透明度较低的系统仍然具有同等程度的可监控性。
在另一篇论文中,Demis Hassabis提出成立一个由美国主导的前沿AI标准机构,以评估先进模型。根据该提议,开发人员最初将在发布前30天内自愿提交模型以供审查。一旦评估系统被证明有效,通过此类测试可能成为在美国部署前沿模型的强制要求。
最初,该机构将在AI公司的参与下设计评估,但最终将创建独立的、未公开的评估——即“预留”测试——以防止实验室针对已知基准优化模型。Hassabis表示,如果情况需要,该框架可以“升级”,可能包括前沿AI开发人员之间的协调放缓。
随着行业安全讨论从一般性担忧转向关于披露、外部审查以及如果安全措施滞后则协调放缓的具体提议,这些论文应运而生。本周,随着行业领袖支持Anthropic首席执行官Dario Amodei呼吁“控制”前沿AI的发展步伐,这种势头进一步增强。
相关文章
Chrome 推出 Gemini 技能库:一键复用提示词,告别重复输入
谷歌已为桌面版Chrome推出了一项更新,为其内置的Gemini功能引入了新的“技能库”。这一改进使用户能够将复杂的AI提示保存为可重复使用的“技能”,以便在各个网页上无缝应用。核心突破:从“聊天框”到“工具箱”此前,用户在使用 AI 时经常需要重新输入背景信息。“技能库”从根本上改变了这种交互模式:自定义技能:用户可保存常见的AI任务(例如:分析组件、比较规格、提取摘要)。下次使用时,只需在侧边
Anthropic首席执行官力推银行式人工智能监管规则,专家警告不宜身兼“球员”与“裁判”双重角色
据CNBC报道,Anthropic首席执行官达里奥·阿莫迪(Dario Amodei)建议在领先的人工智能企业内部设立长期独立的第三方安全评估人员,赋予他们与内部风险团队近乎同等的访问权限,以及在有限限制下独立公布评估结果的权限。 他明确以嵌入式银行监管机构为例,并承诺Anthropic将向第三方评估人员提供与内部风险团队同等的系统访问权限。在周末发表的一篇长文中,阿莫代伊还警告称,在未来6到12
这位风投为何认为2026年将是“消费者之年”
自2022年以来,消费科技初创企业的融资额持续下滑,原因是宏观经济波动和持续通胀使风险投资家对消费者的购买力持谨慎态度。过去几年里,人工智能领域的投资主要瞄准企业客户,因为企业客户预算充裕、合同期限较长,且能带来更快的规模扩张机会。 然而,一位风险投资家预计,消费领域将在2026年迎来复苏。 “这将是消费领域大放异彩的一年,”Premise合伙人、前NEA合伙人瓦妮莎·拉尔科(Vane
相关专题推荐
评论 (0)
0/500

Google和Google DeepMind于周三成立了DeepMind研究所,以促进关于通用人工智能(AGI)的对话。该研究所由DeepMind联合创始人Shane Legg、Google高管James Manyika以及Google DeepMind主席Demis Hassabis领导,其中Legg担任执行编辑。
这一新举措旨在突出Google、DeepMind以及全球研究社区内部关于AGI的多样化观点。公告指出,参与者“可能并不总是达成一致”,并且随着这一快速演进的领域出现新数据,他们可能会修正自己的立场。
首批收录的四篇论文探讨了关键问题:管理潜在AGI颠覆的经济策略、保持人类可读的模型推理、人类繁荣的原则,以及评估前沿AI模型的框架。
DeepMind安全研究人员Rohin Shah和Anca Dragan在一篇论文中指出,AI系统透明度的下降——即逐步检查推理过程的能力——并非不可避免。随着新架构使监控变得复杂,他们建议开发人员和监管机构必须直接解决安全权衡问题。这可能涉及限制“不透明的串行深度”,或要求证明透明度较低的系统仍然具有同等程度的可监控性。
在另一篇论文中,Demis Hassabis提出成立一个由美国主导的前沿AI标准机构,以评估先进模型。根据该提议,开发人员最初将在发布前30天内自愿提交模型以供审查。一旦评估系统被证明有效,通过此类测试可能成为在美国部署前沿模型的强制要求。
最初,该机构将在AI公司的参与下设计评估,但最终将创建独立的、未公开的评估——即“预留”测试——以防止实验室针对已知基准优化模型。Hassabis表示,如果情况需要,该框架可以“升级”,可能包括前沿AI开发人员之间的协调放缓。
随着行业安全讨论从一般性担忧转向关于披露、外部审查以及如果安全措施滞后则协调放缓的具体提议,这些论文应运而生。本周,随着行业领袖支持Anthropic首席执行官Dario Amodei呼吁“控制”前沿AI的发展步伐,这种势头进一步增强。
Chrome 推出 Gemini 技能库:一键复用提示词,告别重复输入
谷歌已为桌面版Chrome推出了一项更新,为其内置的Gemini功能引入了新的“技能库”。这一改进使用户能够将复杂的AI提示保存为可重复使用的“技能”,以便在各个网页上无缝应用。核心突破:从“聊天框”到“工具箱”此前,用户在使用 AI 时经常需要重新输入背景信息。“技能库”从根本上改变了这种交互模式:自定义技能:用户可保存常见的AI任务(例如:分析组件、比较规格、提取摘要)。下次使用时,只需在侧边
Anthropic首席执行官力推银行式人工智能监管规则,专家警告不宜身兼“球员”与“裁判”双重角色
据CNBC报道,Anthropic首席执行官达里奥·阿莫迪(Dario Amodei)建议在领先的人工智能企业内部设立长期独立的第三方安全评估人员,赋予他们与内部风险团队近乎同等的访问权限,以及在有限限制下独立公布评估结果的权限。 他明确以嵌入式银行监管机构为例,并承诺Anthropic将向第三方评估人员提供与内部风险团队同等的系统访问权限。在周末发表的一篇长文中,阿莫代伊还警告称,在未来6到12
这位风投为何认为2026年将是“消费者之年”
自2022年以来,消费科技初创企业的融资额持续下滑,原因是宏观经济波动和持续通胀使风险投资家对消费者的购买力持谨慎态度。过去几年里,人工智能领域的投资主要瞄准企业客户,因为企业客户预算充裕、合同期限较长,且能带来更快的规模扩张机会。 然而,一位风险投资家预计,消费领域将在2026年迎来复苏。 “这将是消费领域大放异彩的一年,”Premise合伙人、前NEA合伙人瓦妮莎·拉尔科(Vane





首页






