实时 AI 消息
阶跃星辰Step 5 Preview称跻身全球开源前三,单任务成本为Claude Opus 5的1/8
据mrjjxw.com报道,阶跃星辰发布Step 5 Preview,称其已跻身全球开源模型前三,并强调单任务成本仅为Claude Opus 5的八分之一。同一篇报道也提醒,榜单成绩之外,该模型在真实场景中的落地仍需攻坚。

国产开源大模型又添一个新面孔。据mrjjxw.com报道,阶跃星辰推出Step 5 Preview,并给出了两个关键说法:一是该模型已跻身全球开源前三,二是单任务成本仅为Claude Opus 5的八分之一。
这两个数字放在一起,指向的是当下开源模型竞争里最实际的一条战线,即不是能不能上榜,而是同等任务下要花多少钱。
把单任务成本压到Claude Opus 5的八分之一,意味着在需要海量调用的Agent、批处理与数据合成场景里,同样的预算可以跑更多轮。
报道同时保留了另一面:榜单之外,场景落地仍需攻坚。这提醒读者,榜单名次由特定评测集与配置决定,而企业真正关心的是长链路任务里的稳定性、工具调用的正确率,以及推理成本的可持续性。
Step 5 Preview的名称中带有Preview,通常意味着这仍是阶段性版本,能力口径与价格口径都可能继续调整,因此上述排名与成本数字更适合看作厂商自测基准下的阶段性结论。
接下来值得关注三点:是否会有第三方独立复测Step 5 Preview在常见开源榜单上的名次;单任务成本的说法建立在什么硬件、上下文长度与并发条件之上;以及阶跃星辰会以何种许可与部署方式开放这套权重。
为什么重要
如果单任务成本的说法在第三方复测中站得住,Step 5 Preview会对开源模型的性价比基准形成直接压力,尤其是在Agent与高并发推理场景。真正的考验仍在于榜单成绩能否转化为稳定的生产可用性。
附近消息
全部09/21 08:00
OpenAI 介绍 V7 实践:用 GPT-5.6 为 AI 智能体建立“机构记忆”
OpenAI 官网发布 V7 的客户实践报道,介绍这家公司如何基于 GPT-5.6 把企业内部散落的文件转化为智能体可直接使用的上下文。报道强调,V7 的目标是让智能体完成复杂任务的同时,每一条结论都能回到原始来源。
09/21 08:55
卷入偷传数据风波后,智谱上线中国最严格数据保护机制
据联合早报报道,智谱在卷入偷传数据风波后上线了一套数据保护机制,报道将其描述为中国最严格的一档。这一动作把大模型厂商的数据处理流程推到台前,机制能否被外部独立验证,将决定用户信任能否真正修复。
09/21 09:07
Plugin4Shell 零点击 RCE 影响四款 AI 编码智能体
据抓取到的报道标题,一个名为 Plugin4Shell 的零点击远程代码执行漏洞影响了四款 AI 编码智能体。零点击意味着触发条件满足时代码即可执行,不需要使用者在界面上做额外操作。
09/21 09:48
比亚迪发布 AI 超级智能体「迪迪虾」:首搭腾势 N8L,多车型陆续 OTA
比亚迪发布汽车行业首个 AI 超级智能体「迪迪虾」,首搭腾势 N8L 纯电车型,基于璇玑架构 2.0 把智能座舱升级为 AI OS。开放生态平台支持 A2A 与 MCP 协议,已接入十余个合作伙伴智能体,第二代腾势 D9、N8L 闪充版、全新 Z9GT 与 N9 闪充版也将陆续推送 OTA。