位置:首页 > 产业资讯 > 小红书大模型IMO满分夺金,第三题解法优雅,中国AI首登数学奥赛

小红书大模型IMO满分夺金,第三题解法优雅,中国AI首登数学奥赛

时间:2026-07-22  |  作者:318050  |  阅读:0

IMO2026成绩揭晓:小红书大模型获满分金牌

第67届国际数学奥林匹克竞赛(IMO2026)的成绩刚刚揭晓。结果有点意思——小红书的大模型 dots-note-3.0 拿下了满分42分,六道题全部答对,直接斩获金牌。

这是中国大模型第一次拿到 IMO 官方金牌级别的认证。也是全球第二个达到这个水准的大模型——注意,是满分。之前谷歌的 Gemini 也只做对了5/6题。

科普:IMO是什么?

IMO 是国际数学奥林匹克竞赛,每年从全球顶尖中学生里挑人。当代菲尔兹奖得主里有一半都参加过这个比赛。赛制是两天,每天4.5小时做3道题,覆盖代数、组合、几何和数论四个方向,每题7分,满分42分。

关键难点在于:参赛者必须写出逻辑完整的证明过程,每一步都要能经得起逐步审查。这对大模型来说,基本上是地狱级难度。

image.png

解题亮点:智能体方式 + 递归自我批判

具体答题时,dots-note-3.0 用的是智能体方式。它把自然语言推理和 Python 代码执行结合起来,一边推演一边用递归自我批判能力反复审视自己的论证。

真正让人眼前一亮的是第三题,一道组合博弈问题。常见解法是把原问题转化成图论连通性问题再建证明,但 dots-note-3.0 另辟蹊径,直接用了归纳法。它紧紧抓住问题最本质的结构,设计出恰到好处的归纳对象和命题。

双CMO金牌得主刘涵祚评价它:“正确且漂亮,结构紧凑、逻辑自然,即使放在 IMO 解答中也属于较为简洁优雅的一类。”另一位 CMO 金牌得主汪千桐则说它“简洁明了而且直击本质,每一步都顺理成章,但人类选手很难想到能从这个角度切入”。

技术意义:基础模型领域的新玩家

对小红书来说,这个 IMO 满分是一次很关键的技术亮相。过去外界对它的技术认知主要集中在内容社区、推荐算法和内容理解上。基础模型这块一直缺少公开、权威的证明。

而 IMO 满分不一样——42分就摆在那里,不需要任何复杂的解释。它足以说明,小红书已经拥有了值得行业认真审视的基础模型能力。基础模型领域又多了一个值得关注的新玩家。据透露,dots-note-3.0 即将开源。

来源:整理自互联网
免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。

相关文章

更多

精选合集

更多

大家都在玩

热门话题

大家都在看

更多