小红书大模型IMO满分夺金,第三题解法优雅,中国AI首登数学奥赛
时间:2026-07-22 | 作者:318050 | 阅读:0IMO2026成绩揭晓:小红书大模型获满分金牌
第67届国际数学奥林匹克竞赛(IMO2026)的成绩刚刚揭晓。结果有点意思——小红书的大模型 dots-note-3.0 拿下了满分42分,六道题全部答对,直接斩获金牌。
这是中国大模型第一次拿到 IMO 官方金牌级别的认证。也是全球第二个达到这个水准的大模型——注意,是满分。之前谷歌的 Gemini 也只做对了5/6题。
科普:IMO是什么?
IMO 是国际数学奥林匹克竞赛,每年从全球顶尖中学生里挑人。当代菲尔兹奖得主里有一半都参加过这个比赛。赛制是两天,每天4.5小时做3道题,覆盖代数、组合、几何和数论四个方向,每题7分,满分42分。
关键难点在于:参赛者必须写出逻辑完整的证明过程,每一步都要能经得起逐步审查。这对大模型来说,基本上是地狱级难度。
解题亮点:智能体方式 + 递归自我批判
具体答题时,dots-note-3.0 用的是智能体方式。它把自然语言推理和 Python 代码执行结合起来,一边推演一边用递归自我批判能力反复审视自己的论证。
真正让人眼前一亮的是第三题,一道组合博弈问题。常见解法是把原问题转化成图论连通性问题再建证明,但 dots-note-3.0 另辟蹊径,直接用了归纳法。它紧紧抓住问题最本质的结构,设计出恰到好处的归纳对象和命题。
双CMO金牌得主刘涵祚评价它:“正确且漂亮,结构紧凑、逻辑自然,即使放在 IMO 解答中也属于较为简洁优雅的一类。”另一位 CMO 金牌得主汪千桐则说它“简洁明了而且直击本质,每一步都顺理成章,但人类选手很难想到能从这个角度切入”。
技术意义:基础模型领域的新玩家
对小红书来说,这个 IMO 满分是一次很关键的技术亮相。过去外界对它的技术认知主要集中在内容社区、推荐算法和内容理解上。基础模型这块一直缺少公开、权威的证明。
而 IMO 满分不一样——42分就摆在那里,不需要任何复杂的解释。它足以说明,小红书已经拥有了值得行业认真审视的基础模型能力。基础模型领域又多了一个值得关注的新玩家。据透露,dots-note-3.0 即将开源。
来源:整理自互联网
免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。
相关文章
更多-
- 纳睿雷达发布睿宸AI气象大模型与相控阵雷达
- 时间:2026-07-25
-
- 葡萄牙国家级大模型阿马利娅历时18个月正式亮相
- 时间:2026-07-25
-
- 阿里开源 Page Agent 实现大模型精准控制网页
- 时间:2026-07-25
-
- 阿里开源Page Agent让大模型读懂网页底层逻辑
- 时间:2026-07-25
-
- 大模型价格战下半场:推理价格持续降低
- 时间:2026-07-25
-
- 大模型评测自动化,回答质量回归测试成AI应用新标配
- 时间:2026-07-25
-
- 魔改P100显卡跑35B大模型提速88% 老卡再战三年
- 时间:2026-07-24
-
- 周鸿祎揭大模型幻觉:烧光一亿Token写周报
- 时间:2026-07-24
精选合集
更多大家都在玩
热门话题
大家都在看
更多-
- iOS 13.5.1电池续航差是电池耗电问题吗
- 时间:2026-07-25
-
- 苹果教育优惠开启 附购买攻略
- 时间:2026-07-25
-
- 苹果iOS 14 beta 2 测试版主要更新内容:除细节变化外修复多项Bug
- 时间:2026-07-25
-
- iOS 14 beta 2 是否解决内存占用过多问题?
- 时间:2026-07-25
-
- 受欢迎的奥特曼游戏有哪些
- 时间:2026-07-25
-
- iOS 14信息应用5大更新变化
- 时间:2026-07-25
-
- iOS 14正式版上线时间公布 官方全新介绍
- 时间:2026-07-25
-
- 最新苹果iOS 14 Beta 2版本更新内容全解析与升级教程
- 时间:2026-07-25
