OpenAI 和谷歌推进数学领域的人工智能发展,但竞争依然存在

OpenAI 和谷歌 DeepMind 的人工智能模型在 2025 年国际数学奥林匹克竞赛(IMO)中获得了金牌,这是世界上最负盛名、难度最大的高中数学竞赛之一。
这些成绩突显了人工智能系统的飞速进步,同时也揭示了谷歌和 OpenAI 在人工智能竞赛中的不相上下。人工智能公司之间的竞争已经超越了技术层面,延伸到了公众认知层面--"氛围 "之争极大地影响了它们吸引顶尖人工智能人才的能力。由于许多人工智能研究人员都有数学背景,因此 IMO 等基准在这一领域具有特殊的分量。
去年,谷歌使用 "正式 "系统将问题翻译成机器可读格式,获得了银奖。今年,两家公司都提交了能够直接处理问题并用自然语言生成证明的 "非正式 "系统。两家公司都声称,他们的人工智能模型正确解决了六个竞赛问题中的五个,超过了大多数人类参赛者和谷歌之前的人工智能系统,而所有这些都不需要人工辅助翻译。
在与 TechCrunch 的讨论中,两家公司的研究人员都将这些金牌成就描述为人工智能在不可验证领域推理的突破。虽然人工智能系统通常擅长基本数学或编码等答案明确的任务,但在选择最佳家具或协助复杂研究等模棱两可的挑战上,它们历来都很吃力。
不过,谷歌对 OpenAI 公布 IMO 结果的方式提出了质疑。毕竟,当人工智能模型参加高中数学竞赛时,一些青春期式的争吵几乎是意料之中的。
就在 OpenAI 周六上午宣布比赛结果后不久,谷歌 DeepMind 的首席执行官和研究人员就在社交媒体上批评 OpenAI 在周五晚上宣布学生获胜后过早地宣布了胜利,而且没有对其模型的表现进行 IMO 官方评估。
Demis Hassabis (@demishassabis) 2025 年 7 月 21 日:作为相关说明,我们推迟了周五的宣布,以尊重国际海事组织理事会的要求,即人工智能实验室只有在经过独立专家的正式验证以及学生们的成就得到适当认可之后才能分享结果。
谷歌 DeepMind 负责 IMO 项目的高级研究员 Thang Luong 向 TechCrunch 解释说,谷歌推迟发布公告是为了表彰学生选手。
Techcrunch 活动科技界和风险投资界重量级人物加入 Disrupt 2025 议程
Netflix、ElevenLabs、Wayve、红杉资本(Sequoia Capital)--这些都是加入 Disrupt 2025 议程的重量级企业。他们将在这里发表真知灼见,助力初创企业成长,提升您的优势。千万不要错过 TechCrunch Disrupt 20 周年纪念活动,以及向科技界顶级人士学习的机会--现在就抢购门票,在价格上涨之前最多可节省 675 美元。
科技界和风险投资界重量级人物加入 Disrupt 2025 议程
Netflix、ElevenLabs、Wayve、红杉资本--这些都是参加 Disrupt 2025 议程的重量级人物。他们将在这里发表真知灼见,助力初创企业成长,提升您的优势。千万不要错过 TechCrunch Disrupt 20 周年纪念活动,以及向科技界的顶尖人物学习的机会--现在就抢购门票,在价格上涨之前最多可节省 675 美元。
旧金山 2025 年 10 月 27-29 日 现在注册Luong指出,在过去的一年中,谷歌一直与IMO组织者合作进行测试准备工作,在周一上午公布验证结果之前,谷歌还寻求IMO主席的正式批准和正式评分。
"Luong 强调说:"IMO 组织者坚持特定的评分准则。"任何不遵循这些标准的评估都不能合法地声称自己的表现达到了金牌水平。"
参与IMO项目的OpenAI高级研究员诺姆-布朗(Noam Brown)告诉TechCrunch,IMO早在几个月前就联系过OpenAI,希望参加正式的数学竞赛,但ChatGPT的创建者拒绝了,而是专注于它认为更有前途的自然语言系统。布朗表示,OpenAI 并不知道 IMO 正在与谷歌进行非正式测试。
OpenAI 报告说,他们聘请了第三方评估人员--三位熟悉评分系统的前 IMO 奖牌获得者--来评估其人工智能模型的性能。布朗说,在得知他们获得金牌后,公司联系了 IMO,IMO 要求他们推迟到周五晚上的颁奖仪式后再公布。
IMO 没有回应 TechCrunch 的置评请求。
虽然谷歌对适当程序的担忧有其道理--因为谷歌经历了一个更正式、更严格的评估过程,但争议可能会掩盖一个更重要的发展:来自顶尖实验室的人工智能模型正在迅速发展。在参加今年国际数学大会的全球最聪明的数学学生中,只有一小部分人的成绩能与 OpenAI 和谷歌的人工智能系统相媲美。
虽然 OpenAI 之前在业界保持着明显的领先优势,但现在的竞争似乎比任何公司愿意承认的都要激烈得多。随着 GPT-5 预计在未来几个月内推出,OpenAI 无疑希望巩固其作为人工智能行业领跑者的地位。
相关文章
在青少年开始使用ChatGPT数年后,OpenAI推出了更安全的ChatGPT版本
在因人工智能聊天机器人缺乏安全协议——这导致了青少年自杀及其他心理健康危机——而引发一系列诉讼后,OpenAI 于周一推出了“ChatGPT for Teens”。这一新产品集成了增强的安全功能,并致力于解决学校中由人工智能工具助长的学术不端行为这一日益严重的问题。从教育角度来看,“ChatGPT for Teens”除了推出“学习模式”外,还提供了其他旨在培养好奇心和解决问题能力的工具,鼓励用户
谷歌推出虚假来电检测功能,以防范AI深度伪造冒充诈骗
谷歌周二宣布,Android将推出虚假来电检测功能,以防范利用AI深度伪造技术实施的冒充诈骗。该功能将于本月通过“Phone by Google”在全球范围内面向Android 12及以上版本的设备逐步推出,首先适用于Pixel设备。随着人们越来越不愿接听陌生号码的来电,诈骗分子正改变策略,通过伪造可信的电话号码,并利用AI深度伪造技术模仿权威人士、家人或雇主的语气进行诈骗。例如,某人可能会接到一
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
相关专题推荐
评论 (2)
0/500
Gold medals at the IMO? That's insane! 🤯 It feels like we're watching sci-fi become reality. But honestly, the 'rivalry' angle in the headline is getting a bit old—can't we just celebrate the collective leap forward? Still, makes me wonder how this will trickle down to actual classroom tools.

OpenAI 和谷歌 DeepMind 的人工智能模型在 2025 年国际数学奥林匹克竞赛(IMO)中获得了金牌,这是世界上最负盛名、难度最大的高中数学竞赛之一。
这些成绩突显了人工智能系统的飞速进步,同时也揭示了谷歌和 OpenAI 在人工智能竞赛中的不相上下。人工智能公司之间的竞争已经超越了技术层面,延伸到了公众认知层面--"氛围 "之争极大地影响了它们吸引顶尖人工智能人才的能力。由于许多人工智能研究人员都有数学背景,因此 IMO 等基准在这一领域具有特殊的分量。
去年,谷歌使用 "正式 "系统将问题翻译成机器可读格式,获得了银奖。今年,两家公司都提交了能够直接处理问题并用自然语言生成证明的 "非正式 "系统。两家公司都声称,他们的人工智能模型正确解决了六个竞赛问题中的五个,超过了大多数人类参赛者和谷歌之前的人工智能系统,而所有这些都不需要人工辅助翻译。
在与 TechCrunch 的讨论中,两家公司的研究人员都将这些金牌成就描述为人工智能在不可验证领域推理的突破。虽然人工智能系统通常擅长基本数学或编码等答案明确的任务,但在选择最佳家具或协助复杂研究等模棱两可的挑战上,它们历来都很吃力。
不过,谷歌对 OpenAI 公布 IMO 结果的方式提出了质疑。毕竟,当人工智能模型参加高中数学竞赛时,一些青春期式的争吵几乎是意料之中的。
就在 OpenAI 周六上午宣布比赛结果后不久,谷歌 DeepMind 的首席执行官和研究人员就在社交媒体上批评 OpenAI 在周五晚上宣布学生获胜后过早地宣布了胜利,而且没有对其模型的表现进行 IMO 官方评估。
Demis Hassabis (@demishassabis) 2025 年 7 月 21 日:作为相关说明,我们推迟了周五的宣布,以尊重国际海事组织理事会的要求,即人工智能实验室只有在经过独立专家的正式验证以及学生们的成就得到适当认可之后才能分享结果。
谷歌 DeepMind 负责 IMO 项目的高级研究员 Thang Luong 向 TechCrunch 解释说,谷歌推迟发布公告是为了表彰学生选手。
Techcrunch 活动科技界和风险投资界重量级人物加入 Disrupt 2025 议程
Netflix、ElevenLabs、Wayve、红杉资本(Sequoia Capital)--这些都是加入 Disrupt 2025 议程的重量级企业。他们将在这里发表真知灼见,助力初创企业成长,提升您的优势。千万不要错过 TechCrunch Disrupt 20 周年纪念活动,以及向科技界顶级人士学习的机会--现在就抢购门票,在价格上涨之前最多可节省 675 美元。
科技界和风险投资界重量级人物加入 Disrupt 2025 议程
Netflix、ElevenLabs、Wayve、红杉资本--这些都是参加 Disrupt 2025 议程的重量级人物。他们将在这里发表真知灼见,助力初创企业成长,提升您的优势。千万不要错过 TechCrunch Disrupt 20 周年纪念活动,以及向科技界的顶尖人物学习的机会--现在就抢购门票,在价格上涨之前最多可节省 675 美元。
旧金山 2025 年 10 月 27-29 日 现在注册Luong指出,在过去的一年中,谷歌一直与IMO组织者合作进行测试准备工作,在周一上午公布验证结果之前,谷歌还寻求IMO主席的正式批准和正式评分。
"Luong 强调说:"IMO 组织者坚持特定的评分准则。"任何不遵循这些标准的评估都不能合法地声称自己的表现达到了金牌水平。"
参与IMO项目的OpenAI高级研究员诺姆-布朗(Noam Brown)告诉TechCrunch,IMO早在几个月前就联系过OpenAI,希望参加正式的数学竞赛,但ChatGPT的创建者拒绝了,而是专注于它认为更有前途的自然语言系统。布朗表示,OpenAI 并不知道 IMO 正在与谷歌进行非正式测试。
OpenAI 报告说,他们聘请了第三方评估人员--三位熟悉评分系统的前 IMO 奖牌获得者--来评估其人工智能模型的性能。布朗说,在得知他们获得金牌后,公司联系了 IMO,IMO 要求他们推迟到周五晚上的颁奖仪式后再公布。
IMO 没有回应 TechCrunch 的置评请求。
虽然谷歌对适当程序的担忧有其道理--因为谷歌经历了一个更正式、更严格的评估过程,但争议可能会掩盖一个更重要的发展:来自顶尖实验室的人工智能模型正在迅速发展。在参加今年国际数学大会的全球最聪明的数学学生中,只有一小部分人的成绩能与 OpenAI 和谷歌的人工智能系统相媲美。
虽然 OpenAI 之前在业界保持着明显的领先优势,但现在的竞争似乎比任何公司愿意承认的都要激烈得多。随着 GPT-5 预计在未来几个月内推出,OpenAI 无疑希望巩固其作为人工智能行业领跑者的地位。
在青少年开始使用ChatGPT数年后,OpenAI推出了更安全的ChatGPT版本
在因人工智能聊天机器人缺乏安全协议——这导致了青少年自杀及其他心理健康危机——而引发一系列诉讼后,OpenAI 于周一推出了“ChatGPT for Teens”。这一新产品集成了增强的安全功能,并致力于解决学校中由人工智能工具助长的学术不端行为这一日益严重的问题。从教育角度来看,“ChatGPT for Teens”除了推出“学习模式”外,还提供了其他旨在培养好奇心和解决问题能力的工具,鼓励用户
谷歌推出虚假来电检测功能,以防范AI深度伪造冒充诈骗
谷歌周二宣布,Android将推出虚假来电检测功能,以防范利用AI深度伪造技术实施的冒充诈骗。该功能将于本月通过“Phone by Google”在全球范围内面向Android 12及以上版本的设备逐步推出,首先适用于Pixel设备。随着人们越来越不愿接听陌生号码的来电,诈骗分子正改变策略,通过伪造可信的电话号码,并利用AI深度伪造技术模仿权威人士、家人或雇主的语气进行诈骗。例如,某人可能会接到一
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
Gold medals at the IMO? That's insane! 🤯 It feels like we're watching sci-fi become reality. But honestly, the 'rivalry' angle in the headline is getting a bit old—can't we just celebrate the collective leap forward? Still, makes me wonder how this will trickle down to actual classroom tools.





首页






