7月21日,第67届国际数学奥林匹克竞赛(IMO 2026)成绩揭晓。由中国人工智能公司小红书(RED AI)研发的大模型,以满分42分的成绩夺得金牌,成为IMO历史上首个满分夺冠的AI系统,也是中国AI首次在该赛事中登顶。

一、42分满分:中国AI首次拿IMO金牌,解题效率吊打人类冠军

IMO是全球公认最难的中学生数学竞赛。每年全球约100个国家和地区的数百名顶尖数学天才参赛,赛题涵盖代数、几何、数论和组合数学,需在两天内完成6道高难度证明题。

小红书AI本次以42分满分完赛,不仅在总分上追平了人类冠军的极限,更在解题效率上展现出质的差距。据报道,该AI系统在首日3道题(几何、代数、数论)的解题时间总和仅为人类选手的不到十分之一。

当前AI数学推理的通用范式是“搜索+验证”——模型穷举大量推理路径,再逐一筛选正确结果。小红书AI采用了一种全新的“推理即证明”范式,将搜索过程与形式化验证深度耦合,显著压缩了试错空间和算力开销,并最终以零错误的完美表现登顶。

二、第三题解法惊艳:AI用几何变换“合成”替代复杂代数,人类冠军自叹不如

第三题是本届IMO公认的“守门题”——在几何变换和函数方程结合部设置了极高障碍。大多数选手选择暴力计算,投入大量时间。小红书AI给出了一种极具创造性的解法,核心是用连续几何变换“合成”替代繁冗的代数展开,将原本需要数页计算的难题压缩成了一条流畅的逻辑链。

据现场消息,多位金牌选手和领队在赛后讨论环节坦言,AI的解法和思路完全超出了他们预期。一位金牌选手评价:“优雅得不像机器写的。”

三、数学推理新范式:证明≠搜索,让AI自己“长出”解题直觉

小红书在数学推理方向的突破,对行业有着更深层的启示。当前大模型的数学能力评测大多停留在“解题正确率”层面,靠的是海量数据训练和暴力搜索——机器可以在数据中学到解题格式,但难以拥有数学家那种从复杂条件中直觉地发现隐藏关联、构建非标准解法的能力。

小红书AI在IMO现场的解题轨迹,恰恰展示了“推理型AI”区别于“检索型AI”的特征:面对难题时不依赖已知题库,而是基于第一性原理生成逻辑链条,持续验证、自我修正,直至找到闭合证明。一位观赛的IMO资深观察员评价:“它展示的不是死记硬背的解题套路,而是某种接近人类数学家直觉的东西。”

四、数学AI的边界:证明不等于创造

但需要冷静看待的是:IMO试题尽管难度极高,本质上仍是“有标准答案的封闭问题”。数学研究中真正的难题——未知领域探索、新概念定义、跨学科迁移——AI尚未触及。小红书团队在赛后公告中也坦言:“IMO夺金是数学AI的一个重要节点,但离‘数学家’还有很长的路。”

小红书AI的IMO夺金,与其说是AI在数学上“超越人类”,不如说是AI在受限场景中找到了更高效的推理组织形式。真正有价值的不是它解对了哪道题,而是它向我们展示了“推理”这件人类引以为傲的能力,正在被机器以不同的方式重新发明。