DeepMind 最新人工智能巧妙解决复杂的数学和科学问题
谷歌著名的人工智能研究部门 DeepMind 推出了 AlphaEvolve,这是一个创新系统,旨在通过可验证的解决方案解决复杂的计算问题。早期测试表明,该系统在优化谷歌人工智能训练基础设施方面的应用前景广阔,目前正在计划开发用户界面,并在可能广泛发布之前启动学术预览计划。
人工智能系统通常要应对幻觉挑战,在这种情况下,概率架构会产生可信但不准确的输出。值得注意的是,一些现代模型与其前身相比,表现出更强的幻觉倾向。AlphaEvolve 引入了一个新颖的验证框架,通过自动评估来缓解这一问题--生成多个候选解决方案,对它们进行严格评估,并为响应的准确性打分。
虽然 AlphaEvolve 并非第一个采用这种方法的系统,但它通过与 Gemini 模型的集成脱颖而出,从而实现了 DeepMind 所称的卓越性能。操作工作流程要求用户在输入问题的同时输入可选的上下文元素,如技术规范、代码示例或参考资料,以及解决方案评分的评估机制。

据DeepMind研究人员称,AlphaEvolve的目标用户是领域专家。
目前的功能主要集中在计算机科学和优化领域的算法求解挑战上,对于非数值问题存在固有的局限性。跨数学学科的性能基准显示,重新发现最优解的成功率为 75%,现有答案的改进率为 20%。
实际应用证明了资源优化的潜力,包括恢复谷歌基础设施的大量计算能力和缩短模型训练时间。虽然没有取得根本性突破,但该系统证明了其在提高运营效率方面的价值--自动化例行优化,使人类专家能够专注于更高价值的研究。
TechCrunch 人工智能大会
领先的行业会议,来自主要人工智能组织的演讲者将以 292 美元的价格全面介绍演讲、研讨会和交流机会。
提供展览空间,向 1200 多名技术决策者展示创新成果。
加利福尼亚州伯克利 6 月 5 日
初步评估表明,AlphaEvolve 最强大的价值主张在于增强而非取代人类的专业知识,将人工智能的计算优势与专业领域知识相结合,加速目标技术领域的解决方案开发。
相关文章
谷歌推出虚假来电检测功能,以防范AI深度伪造冒充诈骗
谷歌周二宣布,Android将推出虚假来电检测功能,以防范利用AI深度伪造技术实施的冒充诈骗。该功能将于本月通过“Phone by Google”在全球范围内面向Android 12及以上版本的设备逐步推出,首先适用于Pixel设备。随着人们越来越不愿接听陌生号码的来电,诈骗分子正改变策略,通过伪造可信的电话号码,并利用AI深度伪造技术模仿权威人士、家人或雇主的语气进行诈骗。例如,某人可能会接到一
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
谷歌在2026年IO大会上推出基于音频技术的智能眼镜,此举与Meta的战略如出一辙
谷歌正战略性地重返智能眼镜市场。在周二举行的谷歌I/O大会上,这家科技巨头宣布与Warby Parker和Gentle Monster合作,推出一系列搭载人工智能的新款眼镜。这些设备由谷歌与三星联合设计,经过优化可与Android和iOS平台无缝集成,计划于今年晚些时候发布。谷歌将这些设备称为“音频眼镜”,用户可通过语音指令进行交互,并利用包括Gemini在内的一系列应用和服务来完成各项任务。图片
相关专题推荐
评论 (1)
0/500
谷歌著名的人工智能研究部门 DeepMind 推出了 AlphaEvolve,这是一个创新系统,旨在通过可验证的解决方案解决复杂的计算问题。早期测试表明,该系统在优化谷歌人工智能训练基础设施方面的应用前景广阔,目前正在计划开发用户界面,并在可能广泛发布之前启动学术预览计划。
人工智能系统通常要应对幻觉挑战,在这种情况下,概率架构会产生可信但不准确的输出。值得注意的是,一些现代模型与其前身相比,表现出更强的幻觉倾向。AlphaEvolve 引入了一个新颖的验证框架,通过自动评估来缓解这一问题--生成多个候选解决方案,对它们进行严格评估,并为响应的准确性打分。
虽然 AlphaEvolve 并非第一个采用这种方法的系统,但它通过与 Gemini 模型的集成脱颖而出,从而实现了 DeepMind 所称的卓越性能。操作工作流程要求用户在输入问题的同时输入可选的上下文元素,如技术规范、代码示例或参考资料,以及解决方案评分的评估机制。

目前的功能主要集中在计算机科学和优化领域的算法求解挑战上,对于非数值问题存在固有的局限性。跨数学学科的性能基准显示,重新发现最优解的成功率为 75%,现有答案的改进率为 20%。
实际应用证明了资源优化的潜力,包括恢复谷歌基础设施的大量计算能力和缩短模型训练时间。虽然没有取得根本性突破,但该系统证明了其在提高运营效率方面的价值--自动化例行优化,使人类专家能够专注于更高价值的研究。
TechCrunch 人工智能大会
领先的行业会议,来自主要人工智能组织的演讲者将以 292 美元的价格全面介绍演讲、研讨会和交流机会。
提供展览空间,向 1200 多名技术决策者展示创新成果。
加利福尼亚州伯克利 6 月 5 日
初步评估表明,AlphaEvolve 最强大的价值主张在于增强而非取代人类的专业知识,将人工智能的计算优势与专业领域知识相结合,加速目标技术领域的解决方案开发。
谷歌推出虚假来电检测功能,以防范AI深度伪造冒充诈骗
谷歌周二宣布,Android将推出虚假来电检测功能,以防范利用AI深度伪造技术实施的冒充诈骗。该功能将于本月通过“Phone by Google”在全球范围内面向Android 12及以上版本的设备逐步推出,首先适用于Pixel设备。随着人们越来越不愿接听陌生号码的来电,诈骗分子正改变策略,通过伪造可信的电话号码,并利用AI深度伪造技术模仿权威人士、家人或雇主的语气进行诈骗。例如,某人可能会接到一
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
谷歌在2026年IO大会上推出基于音频技术的智能眼镜,此举与Meta的战略如出一辙
谷歌正战略性地重返智能眼镜市场。在周二举行的谷歌I/O大会上,这家科技巨头宣布与Warby Parker和Gentle Monster合作,推出一系列搭载人工智能的新款眼镜。这些设备由谷歌与三星联合设计,经过优化可与Android和iOS平台无缝集成,计划于今年晚些时候发布。谷歌将这些设备称为“音频眼镜”,用户可通过语音指令进行交互,并利用包括Gemini在内的一系列应用和服务来完成各项任务。图片





首页






