实时 AI 消息
智谱在财务公告里提前剧透 GLM-6.0,完全自训练方法被公开
据量子位报道,智谱在一份财务公告中提前披露了下一代模型 GLM-6.0,并公开了其完全自训练的方法,而模型本体与相关论文目前尚未发布。本该由技术博客或论文首发的信息先出现在财务文件里,让外界提前看到了智谱下一代模型的训练路线。
智谱的下一代模型 GLM-6.0,先以一份财务公告的方式与外界见了面。据量子位报道,这份财务公告提前披露了 GLM-6.0 的存在,并公开了其完全自训练的方法;报道同时强调,模型本体与相关论文目前都还没有发布。
报道用“剧透”来形容这次披露。目前可确认的信息集中在两点:一是 GLM-6.0 这一代际命名,二是完全自训练这一方法关键词。两者的出现时间都早于常规的技术材料,这让外界第一次看到智谱下一代模型在训练路线上的方向。
对一家大模型公司来说,自训练路线的含义主要落在两个层面。在业内讨论中,它通常被理解为能力来源的问题:模型表现更多由自家数据与训练流程决定,而不是靠外部模型产出的蒸馏数据补齐;同时它也意味着更高的投入门槛,对数据、算力和工程能力的要求都更重。业内之所以对“自训练”三个字敏感,原因大致在此。
更值得琢磨的是披露渠道。模型路线图的常规出口是技术博客、发布会或论文,而这一次最先公开信息的是财务文件。财务公告并非模型发布的常规渠道,但这一次,它让 GLM-6.0 的训练路线比模型本身更早出现在公众视野里。对关注这家公司的人来说,公告类文件正成为一种需要盯住的信源。
需要提醒的是,目前可确认的范围很小。除 GLM-6.0 与完全自训练之外,报道没有给出参数规模、上下文长度、发布时间、基准成绩或开源安排等信息。因此这篇文章能确定的是“存在与路线”,而不是“能力与成绩”。
后续的观察节点比较清楚:官方模型卡与技术报告何时发布、是否开放权重、以及在中文与多语言评测上的表现如何。GLM 系列一直是智谱的主力模型家族,新一代的登场方式本身,已经让外界对这家公司的发布节奏多了一层预期。
在此之前,把完全自训练当作一个方向性信号更为稳妥:它说明智谱希望对外强调训练链路的自主性;至于这条路最终换来什么样的能力,要等模型与论文自己说话。
为什么重要
对国产大模型而言,通过财务文件披露自训练路线,意味着外界评估智谱下一代模型时,除了看榜单成绩,还要看训练自主性与公开发布节奏。
附近消息
全部09/14 09:51
DeepSeek 把 V4-Pro 的 API 流量全部切到 V4.1-Flash,并按 Flash 价格计费
据 Pandaily 报道,DeepSeek 已把发往 V4-Pro 的 API 流量全部路由至 V4.1-Flash,并按 Flash 档位的价格计费。这意味着需要 V4-Pro 能力的请求,现在由 V4.1-Flash 承接,成本侧的预期也随之改变。
09/14 07:01
《泰晤士报》:英国大臣为「保护国家利益」回避对AI施加约束
《泰晤士报》9 月 13 日报道称,英国大臣们在 AI 监管问题上回避了施加约束,给出的理由是保护英国的国家利益。这篇报道把英国政府在安全关切与产业竞争力之间的取舍重新推到台面上,成为观察其先进 AI 规则走向的一个信号。
09/14 11:01
DeepSeek-V4.1-Flash 技术拆解:552B 总参数、8B 激活的 MoE 多模态模型
HackerNoon 对 DeepSeek-V4.1-Flash 的模型卡做了技术梳理:这是一款接受文本与图像输入的多模态混合专家模型,总参数 552B,单次推理只激活约 8B 参数,主打长上下文下的内存与推理效率。模型以 MIT 许可开放权重,支持 1M token 上下文与可调推理强度,但在部分推理基准上仍不及体量更大的 V4-Pro 系列。
09/14 11:18
中国物理AI模型PhysBrain 1.5登顶全球开源榜,空间智能对标GPT-6 Astra
量子位报道称,中国团队的物理AI模型PhysBrain 1.5已登顶全球开源榜一,报道将其描述为跑完了物理闭环里最难的一段路。该模型在空间智能上的表现被拿来与GPT-6 Astra并提,物理AI方向的落地路径因此再次受到关注。