OpenAI宣称在解决这一存在数十年的数学难题方面取得了真正的突破

OpenAI声称,其最新的推理模型生成了一个原创的数学证明,推翻了保罗·埃尔德什于1946年首次提出的著名几何学未解猜想。
若这听起来似曾相识,那是因为OpenAI此前曾做出过类似的大胆宣称。七个月前,该公司前副总裁凯文·韦尔(Kevin Weil)在X平台发文称:“GPT-5找到了10个(!)此前未解的埃尔德什问题的解法,并在另外11个问题上取得了进展。”
事实证明,GPT-5并未真正解决这些问题;它只是重新发现了已记录在现有文献中的解决方案。
这一声明招致了Yann LeCun和谷歌DeepMind首席执行官Demis Hassabis等竞争对手的批评,迫使Weil迅速删除了这篇操之过急的帖子。不过,这次OpenAI似乎避免了重蹈覆辙。在发布新声明的同时,该公司还公布了数学家Noga Alon、Melanie Wood以及Thomas Bloom(他负责维护Erdős问题网站,此前曾将Weil的帖子描述为“严重的误导”)的佐证声明。
“近80年来,数学家们一直认为最佳解类似于方格网格,”OpenAI在X平台声明道,“如今,OpenAI的模型通过发现一套性能更优的全新构造方法,推翻了这一观点。”
该公司称这是“人工智能首次自主解决了一个对数学领域至关重要的著名未解问题”。据OpenAI介绍,该证明源自一个新的通用推理模型,而非专门为解决数学问题——甚至不是为解决这一特定问题而构建的系统。
OpenAI强调了这一成就的重要性,认为它表明AI系统正日益具备维持长而复杂的推理链的能力,并能以研究人员此前可能未曾考虑过的方式,在不同学科间建立联系。这种能力可能对生物学、物理学、工程学和医学等领域产生重要影响。
“人工智能正帮助我们更深入地探索这座历经数百年建造的数学宏伟殿堂,”布鲁姆在一份声明中表示。“还有哪些未被发现的奇迹正等待着我们去探索?”
相关文章
在青少年开始使用ChatGPT数年后,OpenAI推出了更安全的ChatGPT版本
在因人工智能聊天机器人缺乏安全协议——这导致了青少年自杀及其他心理健康危机——而引发一系列诉讼后,OpenAI 于周一推出了“ChatGPT for Teens”。这一新产品集成了增强的安全功能,并致力于解决学校中由人工智能工具助长的学术不端行为这一日益严重的问题。从教育角度来看,“ChatGPT for Teens”除了推出“学习模式”外,还提供了其他旨在培养好奇心和解决问题能力的工具,鼓励用户
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
NEA的蒂芙尼·拉克:企业仍在努力应对人工智能的投资回报率
正在加载播放器…今年早些时候,“token最大化”(tokenmaxxing)在硅谷占据主导地位,首席执行官们敦促员工最大限度地利用人工智能。然而,这种热情很快遭遇了现实。据报道,Uber在几个月内就超出了其年度人工智能预算,一些公司跨部门削减了Claude许可证,而Meta则取消了内部绩效排名。NEA合伙人蒂芙尼·拉克(Tiffany Luck)每天都在应对这种兴奋与实际回报之间的差距。她此前曾成功说服企业电子商务是未来,如今她完全专注于人工智能,特别是其为消费者创造“神奇时刻”的潜力。
相关专题推荐
评论 (0)
0/500

OpenAI声称,其最新的推理模型生成了一个原创的数学证明,推翻了保罗·埃尔德什于1946年首次提出的著名几何学未解猜想。
若这听起来似曾相识,那是因为OpenAI此前曾做出过类似的大胆宣称。七个月前,该公司前副总裁凯文·韦尔(Kevin Weil)在X平台发文称:“GPT-5找到了10个(!)此前未解的埃尔德什问题的解法,并在另外11个问题上取得了进展。”
事实证明,GPT-5并未真正解决这些问题;它只是重新发现了已记录在现有文献中的解决方案。
这一声明招致了Yann LeCun和谷歌DeepMind首席执行官Demis Hassabis等竞争对手的批评,迫使Weil迅速删除了这篇操之过急的帖子。不过,这次OpenAI似乎避免了重蹈覆辙。在发布新声明的同时,该公司还公布了数学家Noga Alon、Melanie Wood以及Thomas Bloom(他负责维护Erdős问题网站,此前曾将Weil的帖子描述为“严重的误导”)的佐证声明。
“近80年来,数学家们一直认为最佳解类似于方格网格,”OpenAI在X平台声明道,“如今,OpenAI的模型通过发现一套性能更优的全新构造方法,推翻了这一观点。”
该公司称这是“人工智能首次自主解决了一个对数学领域至关重要的著名未解问题”。据OpenAI介绍,该证明源自一个新的通用推理模型,而非专门为解决数学问题——甚至不是为解决这一特定问题而构建的系统。
OpenAI强调了这一成就的重要性,认为它表明AI系统正日益具备维持长而复杂的推理链的能力,并能以研究人员此前可能未曾考虑过的方式,在不同学科间建立联系。这种能力可能对生物学、物理学、工程学和医学等领域产生重要影响。
“人工智能正帮助我们更深入地探索这座历经数百年建造的数学宏伟殿堂,”布鲁姆在一份声明中表示。“还有哪些未被发现的奇迹正等待着我们去探索?”
在青少年开始使用ChatGPT数年后,OpenAI推出了更安全的ChatGPT版本
在因人工智能聊天机器人缺乏安全协议——这导致了青少年自杀及其他心理健康危机——而引发一系列诉讼后,OpenAI 于周一推出了“ChatGPT for Teens”。这一新产品集成了增强的安全功能,并致力于解决学校中由人工智能工具助长的学术不端行为这一日益严重的问题。从教育角度来看,“ChatGPT for Teens”除了推出“学习模式”外,还提供了其他旨在培养好奇心和解决问题能力的工具,鼓励用户
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
NEA的蒂芙尼·拉克:企业仍在努力应对人工智能的投资回报率
正在加载播放器…今年早些时候,“token最大化”(tokenmaxxing)在硅谷占据主导地位,首席执行官们敦促员工最大限度地利用人工智能。然而,这种热情很快遭遇了现实。据报道,Uber在几个月内就超出了其年度人工智能预算,一些公司跨部门削减了Claude许可证,而Meta则取消了内部绩效排名。NEA合伙人蒂芙尼·拉克(Tiffany Luck)每天都在应对这种兴奋与实际回报之间的差距。她此前曾成功说服企业电子商务是未来,如今她完全专注于人工智能,特别是其为消费者创造“神奇时刻”的潜力。





首页






