在无人在意的小角落,小红书大模型 dots-note-3.0 以 42 分满分的成绩获得 “42/42 IMO 满分金牌”,并有可能在近期开源 (未经证实)。

同样满分的模型还有 Claude Fable 5 [High], GPT-5.6 Pro (来源), GPT-5.6 Sol [xhigh], Kimi K3 [max]

而此前 IMO 2025 仅有 Gemini Deep Think 大模型拿下了险过金牌线的成绩 (5/6, 35 scores)。

一些相关的新闻 (来自 中国日报):

由于 IMO 考题难度高,且均为证明题,特别考验答题者的抽象思考、逻辑推理能力和论证过程的严谨性,近年来也成为检验大模型智力水平与推理能力的重要场景。但此前仅有谷歌的 Gemini Deep Think 模型在 2025 年的 IMO 中获得过官方评卷认可的金牌水平,完成了 6 道证明题中的 5 道,最终得分 35 分,与当届金牌线持平。

本届 IMO 于 7 月 15 日至 16 日在上海举行,共有来自 120 多个国家和地区的约 685 名参赛学生参加。题目涵盖代数、几何、数论和组合四个领域,每题 7 分,满分 42 分。

针对模型参赛方,组委会在每个比赛日的参赛学生考试结束后发放当日题目,并要求在规定期限内提交答卷,测试期间,严禁实施任何形式的人工干预,包括但不限于人为调整 AI 解题步骤、补充推理逻辑、提示思路、修正答案、筛选结果等。
大模型首次拿下国际数学奥赛满分金牌,来自中国
 
 
Back to Top