实时 AI 消息
小红书大模型dots-note-3.0 IMO 2026满分夺金,中国大模型首次获得官方金牌认证
小红书旗下大模型dots-note-3.0在IMO 2026中六道题全部答对,以满分42分的成绩斩获金牌,成为中国首个获得IMO官方金牌水平认证的大模型。该模型仅用自然语言完成读题到证明的全过程,并在第三题中创新提出了比常规解法更优雅的归纳证明思路。
小红书旗下大模型dots-note-3.0在国际数学奥林匹克竞赛(IMO 2026)中交出了一份满分答卷。经IMO官方评定,该模型六道题全部答对,以42分满分成绩斩获金牌,成为中国大模型首次获得IMO官方金牌水平认证的里程碑事件。这也是继谷歌Gemini之后,全球第二个达到该成绩的大模型。
今年IMO金牌线为29分,较去年下降了6分,意味着本届赛题难度明显提升。小红书dots-note-3.0在满分42分中一分未丢,直接抵达了这套试卷能够衡量的最高点,含金量远超金牌本身。
在解题方式上,dots-note-3.0仅用自然语言就完成了从读题、解析到写证明的全过程,最终答案不仅全部正确,还在部分题目上创新地提出了非常规解法。模型采用智能体方式,结合自然语言与Python代码执行来推理解题,并在推理过程中借助递归自我批判能力审视自己的论证。
第三题的解法尤其令人惊喜。这是一道组合博弈问题,常规解法先将原问题转化为图论中的连通性问题,但dots-note-3.0没有沿袭这条路线,而是转用归纳方法,抓住了问题最本质的结构,设计出了恰到好处的归纳对象与归纳命题。双CMO金牌得主刘涵祚评价说,模型给出了"正确且漂亮的证明思路",汪千桐则认为其解答"非常漂亮也很优雅"。
本届IMO赛事采用严格的实时测评流程。每个比赛日学生考试结束后,模型团队才会收到当天题目,确保模型无法提前进行针对性训练。模型直接阅读英文题目并生成证明,最终答卷由不同国家的IMO评审员按照正式标准审阅。
小红书选择IMO作为基础模型能力的展示窗口,是一次技术亮相反馈。过去外界对小红书的技术认知更多集中在内容社区和推荐算法上,而在基础模型领域缺少公开权威的成绩单。此次IMO满分金牌让行业第一次清晰看到了小红书在基础模型领域的实力。
据悉,对应模型dots-note-3.0即将开源。这意味着行业将有机会更深入地研究其技术架构和推理能力,可能推动中国大模型在AI推理、Agent系统和自主数学解题能力等方面展开新一轮竞争。
为什么重要
小红书以IMO满分成绩展示了其在大模型基础能力上的重大突破,中国大模型首次获得IMO官方金牌认证标志着国内AI推理能力进入新阶段,模型即将开源将进一步推动行业技术竞争。
附近消息
全部07/22 08:00
NTT DATA 借助 OpenAI Codex 将事件分析时间缩短至30分钟,9000名员工采用AI
NTT DATA Group 公布使用 ChatGPT Enterprise 和 OpenAI Codex 的成果:9000名员工已采用AI工具实现工作自动化,事件分析时间从数小时缩短至30分钟。该部署标志着大型企业级AI采用的又一座里程碑。
07/22 07:55
Meta测试AI睡前故事应用StoryKit,定制儿童故事无需动笔
Meta正在测试一款名为StoryKit的AI讲故事应用,可根据用户输入的角色、场景和主题自动生成带音乐的儿童睡前故事。该应用目前仅在部分地区试点,Meta表示正在观察家长们的使用反馈。
07/22 09:46
酷哇科技WAIC 2026发布行业首个双层智能体世界模型,推动城市具身智能
酷哇科技在WAIC 2026上发布了行业首个双层智能体世界模型COOWAM,整合物理世界与人类社会认知。其全地形机器人X0也同步亮相,展示了模块化设计和多场景适应能力。
07/22 09:48
网易有道将推出AI耳机,高级副总裁刘韧磊称Agent正重新定义AI价值
在2026世界人工智能大会(WAIC)上,网易有道高级副总裁刘韧磊宣布将推出AI耳机产品,并发表主题演讲《Agent如何走进学习与办公的真实场景》。刘韧磊强调Agent正在重新定义AI的价值,分享了有道在AI Agent领域的探索成果和产品实践。