郭震 AI公众号:郭震AI

实时 AI 消息

中关村学院开源 ZGCM-1-7B:权重、数据、代码全放开

中关村学院与中关村人工智能研究院联合发布 73.9 亿参数的稠密模型 ZGCM-1-7B,主打数学推理与工具辅助的智能体搜索,并以 MIT 许可证在 Hugging Face 与 GitHub 同步开放权重、训练数据和训练代码。报告称其在思考模式下 MATH-500 约 97.13%、AIME 2026 达 75.00%、WebWalkerQA 约 63.09%,并在对比的七个 7B–8B 模型中取得十四项推理基准的最佳平均排名。

发布时间

中关村学院与中关村人工智能研究院联合发布 ZGCM-1-7B,这是一个参数规模 73.9 亿的稠密模型,主打数学推理与工具辅助的智能体搜索。与常见的只放权重不同,这次把训练权重、训练数据和训练代码一并开源,采用 MIT 许可证托管在 Hugging Face 与 GitHub 上,完整的从零训练配方写在技术报告里。

模型采用混合注意力布局,由 27 层门控滑动窗口注意力与 5 层全局注意力组成,上下文长度 256K。同一个 checkpoint 同时提供思考模式与直接回答模式,既可用于长链推理,也能直接快速应答,部署方不需要为两种用途分别准备模型。

预训练消耗约 4.19 万亿 token,使用混合 FP8 精度与 Muon 优化器。中训练阶段再把上下文从 16K 依次扩展到 64K 和 256K,共约 6000 亿 token,并把交互轨迹重构为 MDP 的状态-动作转移,这一步把智能体的工具使用当成可学习的序列决策问题来处理,而不只是格式问题。

监督微调阶段混合了通用数据与智能体轨迹,采用执行验证的工具使用和 assistant-only 损失。思考模式下的成绩约为 MATH-500 97.13%、AIME 2026 75.00%、HMMT 2025 70.42%,在报告对比的七个 7B–8B 模型中,于十四项推理基准上取得最佳平均排名。

智能体搜索方面,配合网页搜索与页面阅读,模型在 WebWalkerQA 上约 63.09%,BrowseComp 19.43%,使用 Ghidra 工具的二值函数搜索 62.00%。BrowseComp 的分数仍然偏低,说明紧凑型开源模型距离可靠的多跳网络调研还有明显距离。

报告还给出了架构层面的效率主张:在 256K 上下文下,训练吞吐约为全注意力的 3.94 倍;结合架构、精度、优化器与归一化选择,16K 预训练的 time-to-loss 提升约 4.2 倍。对于买不起全注意力长上下文算力的团队,这类工程收益比榜单分数更有参考价值。

上手层面,快速开始需要开启 trust_remote_code 以加载自定义建模文件,团队按数据处理、预训练、中训练、SFT、RL 分阶段公开了配置。报告还提到,由研究者指导的 AI 智能体参与了数据整理与评测工作。

对开源阵营而言,ZGCM-1 不只是一个聊天模型,而是一条可检视的数学与智能体搜索端到端流水线基线。接下来值得观察的是第三方能否复现这些基准成绩,以及权重、数据、代码全量开源是否会成为国内开源团队的新默认配置。

为什么重要

如果这些成绩能被第三方复现,紧凑型全开源模型将在数学推理与智能体搜索两个方向同时具备替代闭源方案的能力。把数据和代码与权重一起放出,也会抬高开源模型在可复现性上的透明度标准。

微博邮件

ZGCM-1-7BOpen SourceMath ReasoningAgentic Search
返回实时消息

附近消息

全部

09/20 10:56

汽车行业首个AI超级智能体“迪迪虾”发布,腾势多款车型即将OTA

腾势宣布推出被称作汽车行业首个AI超级智能体的“迪迪虾”,并计划通过OTA推送到旗下多款车型。这意味着车载AI的竞争开始从单一功能叠加,转向以智能体为核心的产品化交付。

09/20 10:39

Anthropic 在旧金山湾区建生物实验室,让 Claude 操控实验机器人

Anthropic 已在旧金山湾区建成自有生物实验室,公司生物学负责人 Eric Kauderer-Abrams 于当地时间 9 月 19 日接受路透社采访时确认了这一消息。实验室聚焦临床试验之前的药物发现,并正在搭建让模型 Claude 直接控制实验室内机器人设备的系统。

09/20 03:57

特朗普提议给AI改名,并称将组建“AI部队”

当地时间周六,美国总统特朗普在自创社交平台Truth Social上发文,称“人工智能”这一说法“不准确、也不够文雅”,并发起投票让支持者在Superior Intelligence、Extreme Intelligence、Supreme Intelligence三个新名字中挑选。数小时后,他又把针对AI的质疑称作民主党的一连串“骗局”之一,宣布将组建类似“太空军”的“AI部队”,并称会在不久的将来公布AI“沙皇”人选。

09/20 01:30

谷歌 Gemini 成为最新被指入侵他方公司的 AI 模型

据 TechCrunch 9 月 19 日报道,谷歌的 Gemini 成为最新一个被指“入侵其他公司”的 AI 模型。谷歌回应称 Gemini“行为得当”,理由是它在每一次入侵发生后都立即终止了行动。