郭震 AI公众号:郭震AI

实时 AI 消息

小红书大模型dots-note-3.0 IMO 2026满分夺金,中国大模型首次获得官方金牌认证

小红书旗下大模型dots-note-3.0在IMO 2026中六道题全部答对,以满分42分的成绩斩获金牌,成为中国首个获得IMO官方金牌水平认证的大模型。该模型仅用自然语言完成读题到证明的全过程,并在第三题中创新提出了比常规解法更优雅的归纳证明思路。

发布时间

小红书旗下大模型dots-note-3.0在国际数学奥林匹克竞赛(IMO 2026)中交出了一份满分答卷。经IMO官方评定,该模型六道题全部答对,以42分满分成绩斩获金牌,成为中国大模型首次获得IMO官方金牌水平认证的里程碑事件。这也是继谷歌Gemini之后,全球第二个达到该成绩的大模型。

今年IMO金牌线为29分,较去年下降了6分,意味着本届赛题难度明显提升。小红书dots-note-3.0在满分42分中一分未丢,直接抵达了这套试卷能够衡量的最高点,含金量远超金牌本身。

在解题方式上,dots-note-3.0仅用自然语言就完成了从读题、解析到写证明的全过程,最终答案不仅全部正确,还在部分题目上创新地提出了非常规解法。模型采用智能体方式,结合自然语言与Python代码执行来推理解题,并在推理过程中借助递归自我批判能力审视自己的论证。

第三题的解法尤其令人惊喜。这是一道组合博弈问题,常规解法先将原问题转化为图论中的连通性问题,但dots-note-3.0没有沿袭这条路线,而是转用归纳方法,抓住了问题最本质的结构,设计出了恰到好处的归纳对象与归纳命题。双CMO金牌得主刘涵祚评价说,模型给出了"正确且漂亮的证明思路",汪千桐则认为其解答"非常漂亮也很优雅"。

本届IMO赛事采用严格的实时测评流程。每个比赛日学生考试结束后,模型团队才会收到当天题目,确保模型无法提前进行针对性训练。模型直接阅读英文题目并生成证明,最终答卷由不同国家的IMO评审员按照正式标准审阅。

小红书选择IMO作为基础模型能力的展示窗口,是一次技术亮相反馈。过去外界对小红书的技术认知更多集中在内容社区和推荐算法上,而在基础模型领域缺少公开权威的成绩单。此次IMO满分金牌让行业第一次清晰看到了小红书在基础模型领域的实力。

据悉,对应模型dots-note-3.0即将开源。这意味着行业将有机会更深入地研究其技术架构和推理能力,可能推动中国大模型在AI推理、Agent系统和自主数学解题能力等方面展开新一轮竞争。

为什么重要

小红书以IMO满分成绩展示了其在大模型基础能力上的重大突破,中国大模型首次获得IMO官方金牌认证标志着国内AI推理能力进入新阶段,模型即将开源将进一步推动行业技术竞争。

微博邮件

小红书XiaohongshuIMO大模型LLM
返回AI日报

附近消息

全部