郭震 AI公众号:郭震AI

实时 AI 消息

智谱在财务公告里提前剧透 GLM-6.0,完全自训练方法被公开

据量子位报道,智谱在一份财务公告中提前披露了下一代模型 GLM-6.0,并公开了其完全自训练的方法,而模型本体与相关论文目前尚未发布。本该由技术博客或论文首发的信息先出现在财务文件里,让外界提前看到了智谱下一代模型的训练路线。

发布时间

智谱的下一代模型 GLM-6.0,先以一份财务公告的方式与外界见了面。据量子位报道,这份财务公告提前披露了 GLM-6.0 的存在,并公开了其完全自训练的方法;报道同时强调,模型本体与相关论文目前都还没有发布。

报道用“剧透”来形容这次披露。目前可确认的信息集中在两点:一是 GLM-6.0 这一代际命名,二是完全自训练这一方法关键词。两者的出现时间都早于常规的技术材料,这让外界第一次看到智谱下一代模型在训练路线上的方向。

对一家大模型公司来说,自训练路线的含义主要落在两个层面。在业内讨论中,它通常被理解为能力来源的问题:模型表现更多由自家数据与训练流程决定,而不是靠外部模型产出的蒸馏数据补齐;同时它也意味着更高的投入门槛,对数据、算力和工程能力的要求都更重。业内之所以对“自训练”三个字敏感,原因大致在此。

更值得琢磨的是披露渠道。模型路线图的常规出口是技术博客、发布会或论文,而这一次最先公开信息的是财务文件。财务公告并非模型发布的常规渠道,但这一次,它让 GLM-6.0 的训练路线比模型本身更早出现在公众视野里。对关注这家公司的人来说,公告类文件正成为一种需要盯住的信源。

需要提醒的是,目前可确认的范围很小。除 GLM-6.0 与完全自训练之外,报道没有给出参数规模、上下文长度、发布时间、基准成绩或开源安排等信息。因此这篇文章能确定的是“存在与路线”,而不是“能力与成绩”。

后续的观察节点比较清楚:官方模型卡与技术报告何时发布、是否开放权重、以及在中文与多语言评测上的表现如何。GLM 系列一直是智谱的主力模型家族,新一代的登场方式本身,已经让外界对这家公司的发布节奏多了一层预期。

在此之前,把完全自训练当作一个方向性信号更为稳妥:它说明智谱希望对外强调训练链路的自主性;至于这条路最终换来什么样的能力,要等模型与论文自己说话。

为什么重要

对国产大模型而言,通过财务文件披露自训练路线,意味着外界评估智谱下一代模型时,除了看榜单成绩,还要看训练自主性与公开发布节奏。

微博邮件

智谱GLM-6.0大模型训练
返回实时消息

附近消息

全部

09/14 09:51

DeepSeek 把 V4-Pro 的 API 流量全部切到 V4.1-Flash,并按 Flash 价格计费

据 Pandaily 报道,DeepSeek 已把发往 V4-Pro 的 API 流量全部路由至 V4.1-Flash,并按 Flash 档位的价格计费。这意味着需要 V4-Pro 能力的请求,现在由 V4.1-Flash 承接,成本侧的预期也随之改变。

09/14 07:01

《泰晤士报》:英国大臣为「保护国家利益」回避对AI施加约束

《泰晤士报》9 月 13 日报道称,英国大臣们在 AI 监管问题上回避了施加约束,给出的理由是保护英国的国家利益。这篇报道把英国政府在安全关切与产业竞争力之间的取舍重新推到台面上,成为观察其先进 AI 规则走向的一个信号。

09/14 05:03

马斯克欢迎 Grok 接入微软 Copilot,纳德拉强调更多模型选择

微软 CEO 纳德拉宣布把 xAI 的 Grok 模型接入 Microsoft Copilot,称这为用户带来更多模型选择,马斯克 9 月 12 日在 X 上回应表示欢迎。此次接入初期聚焦 Word、Excel 和 PowerPoint 中的 Copilot 体验,推送从参与微软 Frontier 计划的客户开始。

09/14 04:10

约翰逊回应AI降速呼声:国会不能下暂停令,“中国会追上我们”

美国众议院议长迈克·约翰逊在CNN《国情咨文》节目中回应头部AI公司CEO的降速呼吁,拒绝由国会出手监管,称“我们不能对这件事下暂停令,因为中国会追上我们”,安全应由行业自己负责。同日特朗普也表示美国在AI上领先中国、“谁赢得AI谁就赢得一切”,可以设置护栏,但不应被“负面力量”推着走。