OpenAI 和谷歌推进数学领域的人工智能发展,但竞争依然存在

OpenAI 和谷歌 DeepMind 的人工智能模型在 2025 年国际数学奥林匹克竞赛(IMO)中获得了金牌,这是世界上最负盛名、难度最大的高中数学竞赛之一。
这些成绩突显了人工智能系统的飞速进步,同时也揭示了谷歌和 OpenAI 在人工智能竞赛中的不相上下。人工智能公司之间的竞争已经超越了技术层面,延伸到了公众认知层面--"氛围 "之争极大地影响了它们吸引顶尖人工智能人才的能力。由于许多人工智能研究人员都有数学背景,因此 IMO 等基准在这一领域具有特殊的分量。
去年,谷歌使用 "正式 "系统将问题翻译成机器可读格式,获得了银奖。今年,两家公司都提交了能够直接处理问题并用自然语言生成证明的 "非正式 "系统。两家公司都声称,他们的人工智能模型正确解决了六个竞赛问题中的五个,超过了大多数人类参赛者和谷歌之前的人工智能系统,而所有这些都不需要人工辅助翻译。
在与 TechCrunch 的讨论中,两家公司的研究人员都将这些金牌成就描述为人工智能在不可验证领域推理的突破。虽然人工智能系统通常擅长基本数学或编码等答案明确的任务,但在选择最佳家具或协助复杂研究等模棱两可的挑战上,它们历来都很吃力。
不过,谷歌对 OpenAI 公布 IMO 结果的方式提出了质疑。毕竟,当人工智能模型参加高中数学竞赛时,一些青春期式的争吵几乎是意料之中的。
就在 OpenAI 周六上午宣布比赛结果后不久,谷歌 DeepMind 的首席执行官和研究人员就在社交媒体上批评 OpenAI 在周五晚上宣布学生获胜后过早地宣布了胜利,而且没有对其模型的表现进行 IMO 官方评估。
Demis Hassabis (@demishassabis) 2025 年 7 月 21 日:作为相关说明,我们推迟了周五的宣布,以尊重国际海事组织理事会的要求,即人工智能实验室只有在经过独立专家的正式验证以及学生们的成就得到适当认可之后才能分享结果。
谷歌 DeepMind 负责 IMO 项目的高级研究员 Thang Luong 向 TechCrunch 解释说,谷歌推迟发布公告是为了表彰学生选手。
Techcrunch 活动科技界和风险投资界重量级人物加入 Disrupt 2025 议程
Netflix、ElevenLabs、Wayve、红杉资本(Sequoia Capital)--这些都是加入 Disrupt 2025 议程的重量级企业。他们将在这里发表真知灼见,助力初创企业成长,提升您的优势。千万不要错过 TechCrunch Disrupt 20 周年纪念活动,以及向科技界顶级人士学习的机会--现在就抢购门票,在价格上涨之前最多可节省 675 美元。
科技界和风险投资界重量级人物加入 Disrupt 2025 议程
Netflix、ElevenLabs、Wayve、红杉资本--这些都是参加 Disrupt 2025 议程的重量级人物。他们将在这里发表真知灼见,助力初创企业成长,提升您的优势。千万不要错过 TechCrunch Disrupt 20 周年纪念活动,以及向科技界的顶尖人物学习的机会--现在就抢购门票,在价格上涨之前最多可节省 675 美元。
旧金山 2025 年 10 月 27-29 日 现在注册Luong指出,在过去的一年中,谷歌一直与IMO组织者合作进行测试准备工作,在周一上午公布验证结果之前,谷歌还寻求IMO主席的正式批准和正式评分。
"Luong 强调说:"IMO 组织者坚持特定的评分准则。"任何不遵循这些标准的评估都不能合法地声称自己的表现达到了金牌水平。"
参与IMO项目的OpenAI高级研究员诺姆-布朗(Noam Brown)告诉TechCrunch,IMO早在几个月前就联系过OpenAI,希望参加正式的数学竞赛,但ChatGPT的创建者拒绝了,而是专注于它认为更有前途的自然语言系统。布朗表示,OpenAI 并不知道 IMO 正在与谷歌进行非正式测试。
OpenAI 报告说,他们聘请了第三方评估人员--三位熟悉评分系统的前 IMO 奖牌获得者--来评估其人工智能模型的性能。布朗说,在得知他们获得金牌后,公司联系了 IMO,IMO 要求他们推迟到周五晚上的颁奖仪式后再公布。
IMO 没有回应 TechCrunch 的置评请求。
虽然谷歌对适当程序的担忧有其道理--因为谷歌经历了一个更正式、更严格的评估过程,但争议可能会掩盖一个更重要的发展:来自顶尖实验室的人工智能模型正在迅速发展。在参加今年国际数学大会的全球最聪明的数学学生中,只有一小部分人的成绩能与 OpenAI 和谷歌的人工智能系统相媲美。
虽然 OpenAI 之前在业界保持着明显的领先优势,但现在的竞争似乎比任何公司愿意承认的都要激烈得多。随着 GPT-5 预计在未来几个月内推出,OpenAI 无疑希望巩固其作为人工智能行业领跑者的地位。
相关文章
山姆·奥特曼引发关于人工智能减速的辩论
在Apple Podcasts上收听在Spotify上收听OpenAI首席执行官萨姆·阿尔特曼(Sam Altman)最近表示,现在可能是时候“控制人工智能的发展速度”,以便社会“在这些新的能力水平周围加固自身”。在TechCrunch《Equity》播客的最新一期中,Kirsten Korosec、Sean O’Kane和我讨论了阿尔特曼的言论可能由最近的一次黑客攻击所触发,该攻击中一名OpenAI代理突破了Hugging Face的系统。Sean指出,虽然由AI代理执行的黑客攻击是前所未
OpenAI 与苹果公司就商业秘密诉讼进行对抗
OpenAI 于周二驳回了苹果公司的商业秘密指控,称该诉讼毫无根据。“我们认真对待这些指控,但未发现任何支持它们的证据,”OpenAI 表示,据彭博社记者 Ed Ludlow 在 X 平台报道,“我们支持公平竞争和工作自由,专注于创造赋能全球用户的技术。”此前,苹果公司于周五在美国加利福尼亚州北区联邦地区法院提起诉讼,指控 OpenAI 策划了一项从前苹果员工处窃取机密数据和知识产权的计划。这份长达 41 页的诉状针对 OpenAI 的高管层,包括首席硬件官 Tang Tan,他是一名拥有
OpenAI机器人项目主管凯特琳·卡利诺夫斯基因五角大楼合作项目辞职
OpenAI 机器人业务负责人凯特琳·卡利诺夫斯基(Caitlin Kalinowski)在该公司与国防部达成备受争议的合作伙伴关系后辞职。“这不是一个轻松的决定,”卡利诺夫斯基在社交媒体声明中解释道。“虽然人工智能在国家安全中发挥着至关重要的作用,但在没有司法监督的情况下对美国公民进行监视,以及在未经人类授权的情况下部署致命自主武器,都是需要更加慎重考虑的界限。”卡利诺夫斯基此前因领导 Meta 的增强现实眼镜部门而闻名,她于 2024 年 11 月加入 OpenAI。在辞职信中,她强调她
相关专题推荐
评论 (2)
0/500
Gold medals at the IMO? That's insane! 🤯 It feels like we're watching sci-fi become reality. But honestly, the 'rivalry' angle in the headline is getting a bit old—can't we just celebrate the collective leap forward? Still, makes me wonder how this will trickle down to actual classroom tools.

OpenAI 和谷歌 DeepMind 的人工智能模型在 2025 年国际数学奥林匹克竞赛(IMO)中获得了金牌,这是世界上最负盛名、难度最大的高中数学竞赛之一。
这些成绩突显了人工智能系统的飞速进步,同时也揭示了谷歌和 OpenAI 在人工智能竞赛中的不相上下。人工智能公司之间的竞争已经超越了技术层面,延伸到了公众认知层面--"氛围 "之争极大地影响了它们吸引顶尖人工智能人才的能力。由于许多人工智能研究人员都有数学背景,因此 IMO 等基准在这一领域具有特殊的分量。
去年,谷歌使用 "正式 "系统将问题翻译成机器可读格式,获得了银奖。今年,两家公司都提交了能够直接处理问题并用自然语言生成证明的 "非正式 "系统。两家公司都声称,他们的人工智能模型正确解决了六个竞赛问题中的五个,超过了大多数人类参赛者和谷歌之前的人工智能系统,而所有这些都不需要人工辅助翻译。
在与 TechCrunch 的讨论中,两家公司的研究人员都将这些金牌成就描述为人工智能在不可验证领域推理的突破。虽然人工智能系统通常擅长基本数学或编码等答案明确的任务,但在选择最佳家具或协助复杂研究等模棱两可的挑战上,它们历来都很吃力。
不过,谷歌对 OpenAI 公布 IMO 结果的方式提出了质疑。毕竟,当人工智能模型参加高中数学竞赛时,一些青春期式的争吵几乎是意料之中的。
就在 OpenAI 周六上午宣布比赛结果后不久,谷歌 DeepMind 的首席执行官和研究人员就在社交媒体上批评 OpenAI 在周五晚上宣布学生获胜后过早地宣布了胜利,而且没有对其模型的表现进行 IMO 官方评估。
Demis Hassabis (@demishassabis) 2025 年 7 月 21 日:作为相关说明,我们推迟了周五的宣布,以尊重国际海事组织理事会的要求,即人工智能实验室只有在经过独立专家的正式验证以及学生们的成就得到适当认可之后才能分享结果。
谷歌 DeepMind 负责 IMO 项目的高级研究员 Thang Luong 向 TechCrunch 解释说,谷歌推迟发布公告是为了表彰学生选手。
Techcrunch 活动科技界和风险投资界重量级人物加入 Disrupt 2025 议程
Netflix、ElevenLabs、Wayve、红杉资本(Sequoia Capital)--这些都是加入 Disrupt 2025 议程的重量级企业。他们将在这里发表真知灼见,助力初创企业成长,提升您的优势。千万不要错过 TechCrunch Disrupt 20 周年纪念活动,以及向科技界顶级人士学习的机会--现在就抢购门票,在价格上涨之前最多可节省 675 美元。
科技界和风险投资界重量级人物加入 Disrupt 2025 议程
Netflix、ElevenLabs、Wayve、红杉资本--这些都是参加 Disrupt 2025 议程的重量级人物。他们将在这里发表真知灼见,助力初创企业成长,提升您的优势。千万不要错过 TechCrunch Disrupt 20 周年纪念活动,以及向科技界的顶尖人物学习的机会--现在就抢购门票,在价格上涨之前最多可节省 675 美元。
旧金山 2025 年 10 月 27-29 日 现在注册Luong指出,在过去的一年中,谷歌一直与IMO组织者合作进行测试准备工作,在周一上午公布验证结果之前,谷歌还寻求IMO主席的正式批准和正式评分。
"Luong 强调说:"IMO 组织者坚持特定的评分准则。"任何不遵循这些标准的评估都不能合法地声称自己的表现达到了金牌水平。"
参与IMO项目的OpenAI高级研究员诺姆-布朗(Noam Brown)告诉TechCrunch,IMO早在几个月前就联系过OpenAI,希望参加正式的数学竞赛,但ChatGPT的创建者拒绝了,而是专注于它认为更有前途的自然语言系统。布朗表示,OpenAI 并不知道 IMO 正在与谷歌进行非正式测试。
OpenAI 报告说,他们聘请了第三方评估人员--三位熟悉评分系统的前 IMO 奖牌获得者--来评估其人工智能模型的性能。布朗说,在得知他们获得金牌后,公司联系了 IMO,IMO 要求他们推迟到周五晚上的颁奖仪式后再公布。
IMO 没有回应 TechCrunch 的置评请求。
虽然谷歌对适当程序的担忧有其道理--因为谷歌经历了一个更正式、更严格的评估过程,但争议可能会掩盖一个更重要的发展:来自顶尖实验室的人工智能模型正在迅速发展。在参加今年国际数学大会的全球最聪明的数学学生中,只有一小部分人的成绩能与 OpenAI 和谷歌的人工智能系统相媲美。
虽然 OpenAI 之前在业界保持着明显的领先优势,但现在的竞争似乎比任何公司愿意承认的都要激烈得多。随着 GPT-5 预计在未来几个月内推出,OpenAI 无疑希望巩固其作为人工智能行业领跑者的地位。
山姆·奥特曼引发关于人工智能减速的辩论
在Apple Podcasts上收听在Spotify上收听OpenAI首席执行官萨姆·阿尔特曼(Sam Altman)最近表示,现在可能是时候“控制人工智能的发展速度”,以便社会“在这些新的能力水平周围加固自身”。在TechCrunch《Equity》播客的最新一期中,Kirsten Korosec、Sean O’Kane和我讨论了阿尔特曼的言论可能由最近的一次黑客攻击所触发,该攻击中一名OpenAI代理突破了Hugging Face的系统。Sean指出,虽然由AI代理执行的黑客攻击是前所未
OpenAI 与苹果公司就商业秘密诉讼进行对抗
OpenAI 于周二驳回了苹果公司的商业秘密指控,称该诉讼毫无根据。“我们认真对待这些指控,但未发现任何支持它们的证据,”OpenAI 表示,据彭博社记者 Ed Ludlow 在 X 平台报道,“我们支持公平竞争和工作自由,专注于创造赋能全球用户的技术。”此前,苹果公司于周五在美国加利福尼亚州北区联邦地区法院提起诉讼,指控 OpenAI 策划了一项从前苹果员工处窃取机密数据和知识产权的计划。这份长达 41 页的诉状针对 OpenAI 的高管层,包括首席硬件官 Tang Tan,他是一名拥有
OpenAI机器人项目主管凯特琳·卡利诺夫斯基因五角大楼合作项目辞职
OpenAI 机器人业务负责人凯特琳·卡利诺夫斯基(Caitlin Kalinowski)在该公司与国防部达成备受争议的合作伙伴关系后辞职。“这不是一个轻松的决定,”卡利诺夫斯基在社交媒体声明中解释道。“虽然人工智能在国家安全中发挥着至关重要的作用,但在没有司法监督的情况下对美国公民进行监视,以及在未经人类授权的情况下部署致命自主武器,都是需要更加慎重考虑的界限。”卡利诺夫斯基此前因领导 Meta 的增强现实眼镜部门而闻名,她于 2024 年 11 月加入 OpenAI。在辞职信中,她强调她
Gold medals at the IMO? That's insane! 🤯 It feels like we're watching sci-fi become reality. But honestly, the 'rivalry' angle in the headline is getting a bit old—can't we just celebrate the collective leap forward? Still, makes me wonder how this will trickle down to actual classroom tools.





首页






