实时 AI 消息
小红书大模型dots-note-3.0 IMO 2026满分夺金,中国大模型首次获得官方金牌认证
小红书旗下大模型dots-note-3.0在IMO 2026中六道题全部答对,以满分42分的成绩斩获金牌,成为中国首个获得IMO官方金牌水平认证的大模型。该模型仅用自然语言完成读题到证明的全过程,并在第三题中创新提出了比常规解法更优雅的归纳证明思路。
小红书旗下大模型dots-note-3.0在国际数学奥林匹克竞赛(IMO 2026)中交出了一份满分答卷。经IMO官方评定,该模型六道题全部答对,以42分满分成绩斩获金牌,成为中国大模型首次获得IMO官方金牌水平认证的里程碑事件。这也是继谷歌Gemini之后,全球第二个达到该成绩的大模型。
今年IMO金牌线为29分,较去年下降了6分,意味着本届赛题难度明显提升。小红书dots-note-3.0在满分42分中一分未丢,直接抵达了这套试卷能够衡量的最高点,含金量远超金牌本身。
在解题方式上,dots-note-3.0仅用自然语言就完成了从读题、解析到写证明的全过程,最终答案不仅全部正确,还在部分题目上创新地提出了非常规解法。模型采用智能体方式,结合自然语言与Python代码执行来推理解题,并在推理过程中借助递归自我批判能力审视自己的论证。
第三题的解法尤其令人惊喜。这是一道组合博弈问题,常规解法先将原问题转化为图论中的连通性问题,但dots-note-3.0没有沿袭这条路线,而是转用归纳方法,抓住了问题最本质的结构,设计出了恰到好处的归纳对象与归纳命题。双CMO金牌得主刘涵祚评价说,模型给出了"正确且漂亮的证明思路",汪千桐则认为其解答"非常漂亮也很优雅"。
本届IMO赛事采用严格的实时测评流程。每个比赛日学生考试结束后,模型团队才会收到当天题目,确保模型无法提前进行针对性训练。模型直接阅读英文题目并生成证明,最终答卷由不同国家的IMO评审员按照正式标准审阅。
小红书选择IMO作为基础模型能力的展示窗口,是一次技术亮相反馈。过去外界对小红书的技术认知更多集中在内容社区和推荐算法上,而在基础模型领域缺少公开权威的成绩单。此次IMO满分金牌让行业第一次清晰看到了小红书在基础模型领域的实力。
据悉,对应模型dots-note-3.0即将开源。这意味着行业将有机会更深入地研究其技术架构和推理能力,可能推动中国大模型在AI推理、Agent系统和自主数学解题能力等方面展开新一轮竞争。
为什么重要
小红书以IMO满分成绩展示了其在大模型基础能力上的重大突破,中国大模型首次获得IMO官方金牌认证标志着国内AI推理能力进入新阶段,模型即将开源将进一步推动行业技术竞争。
附近消息
全部07/22 07:55
Meta测试AI睡前故事应用StoryKit,定制儿童故事无需动笔
Meta正在测试一款名为StoryKit的AI讲故事应用,可根据用户输入的角色、场景和主题自动生成带音乐的儿童睡前故事。该应用目前仅在部分地区试点,Meta表示正在观察家长们的使用反馈。
07/22 09:48
网易有道将推出AI耳机,高级副总裁刘韧磊称Agent正重新定义AI价值
在2026世界人工智能大会(WAIC)上,网易有道高级副总裁刘韧磊宣布将推出AI耳机产品,并发表主题演讲《Agent如何走进学习与办公的真实场景》。刘韧磊强调Agent正在重新定义AI的价值,分享了有道在AI Agent领域的探索成果和产品实践。
07/22 06:35
AI动态:Built in Fort Worth: Wistron Opens Advanced Manufacturing Plant to Produce NVIDIA AI Systems
据 blogs.nvidia.com 消息,Built in Fort Worth: Wistron Opens Advanced Manufacturing Plant to Produce NVIDIA AI Systems。The AI era runs on AI infrastructure. Many of these advanced systems are built and tested in Texas. Wistron opened its first U.S. manufacturing facility today in Fort Worth — a 324,000 square foot greenfield plant producing superchips at the heart of some of t...
07/22 03:48
Hugging Face 遭入侵,OpenAI 声称其模型与泄露数据有关
AI 模型托管平台 Hugging Face 遭遇安全入侵事件,OpenAI 方面声称其模型与被泄露的数据有关。这一事件由 Axios 报道,引发业界对 AI 模型供应链安全的新一轮担忧。