第67届国际数学奥林匹克竞赛(IMO2026)成绩正式揭晓,结果令人瞩目——小红书自研的大模型 dots-note-3.0 以满分42分完成全部六道题目,一举夺得金牌。这不仅是国内大模型首次获得 IMO 官方金牌级别的认证,更是全球第二个达到这一水准的模型,且是满分成绩。相比之下,谷歌 Gemini 此前仅完成了5/6题。
科普一下:IMO 是国际数学奥林匹克竞赛,每年从全球顶尖中学生中选拔选手,当代菲尔兹奖得主中有一半曾参与过该赛事。赛制为两天,每天4.5小时完成3道题,涵盖代数、组合、几何与数论四大领域,每道题7分,满分42分。核心难点在于,参赛者必须写出逻辑严密的证明过程,每一步骤都要经得起逐层推敲——这对大模型而言,堪称地狱级难度。

在具体答题过程中,dots-note-3.0 采用智能体方式,将自然语言推理与 Python 代码执行相结合,边推演边利用递归自我批判能力反复审视自身论证。真正令人眼前一亮的是第三题,一道组合博弈问题。常规解法是将原问题转化为图论连通性问题再构建证明,但 dots-note-3.0 另辟蹊径,直接运用归纳法,紧紧抓住问题本质结构,设计了恰到好处的归纳对象与命题。双 CMO 金牌得主刘涵祚评价其“正确且漂亮,结构紧凑、逻辑自然,即使放在 IMO 解答中也属于较为简洁优雅的一类”。另一位 CMO 金牌得主汪千桐则称其“简洁明了且直击本质,每一步都顺理成章,但人类选手很难想到从这个角度切入”。
对于小红书而言,这个 IMO 满分是一次关键的技术亮相。此前外界对它的技术认知主要集中于内容社区、推荐算法与内容理解,基础模型领域一直缺乏公开、权威的证明。而 IMO 满分不同——42分摆在那里,无需任何复杂解释。它足以证明,小红书已具备值得行业认真审视的基础模型能力,基础模型领域又多了一位值得关注的新玩家。据透露,dots-note-3.0 即将开源。
