2025-07
Google DeepMind 的 Gemini Deep Think 在国际数学奥林匹克竞赛中获得金牌
事件摘要
2025 年 7 月,Google DeepMind 宣布带 Deep Think 功能的增强版 Gemini 在国际数学奥林匹克竞赛中达到了金牌标准,获得了 42 分中的 35 分。这标志着 AI 系统首次达到世界最负盛名的大学预科数学竞赛的最高水平——解决了需要深度数学推理、创造力和多步骤逻辑的问题。这一成就证明了推理时计算缩放可以匹配最具挑战性的人类智力基准。
影响评估
-
能力跃迁 +3 · 长期
AI 在国际数学奥林匹克竞赛——世界最具挑战性的大学预科数学竞赛——中达到了金牌水平。获得 35/42 分,超过了大多数人类参赛者。证明了通用 LLM 可以匹配顶级人类的数学推理能力。
受影响群体: mathematicians、AI researchers、educators、students
-
认知转变 +2 · 长期
验证了推理时计算缩放作为达到专家级推理的路径。证明了在推理时投入更多计算(Deep Think)可以匹配训练更大模型——强化了 o1 引入的推理模型范式。
受影响群体: AI researchers、ML engineers、AI companies
共识度与来源
重要度
L2
分类
能力突破
共识度
广泛共识
影响指数
7/10
-
1
Advanced version of Gemini with Deep Think officially achieves gold-medal standard at the International Mathematical Olympiad.参考证据 引用已记录 原文可访问
-
2
Gemini Deep Think earns gold at International Math Olympiad.新闻报道 引用已记录 原文可访问