实时 AI 消息
智谱GLM-5.3-Flash全面激活国产算力:320B总参、18B激活参数的混合注意力新架构
国联民生证券最新研报显示,智谱新一代大模型GLM-5.3-Flash正从架构与系统层面对国产算力进行适配优化,激活参数由32B压缩至18B,并采用线性注意力与稀疏注意力混合架构。这是国产大模型把算力效率作为与本土芯片协同核心策略的最新信号。
国联民生证券计算机团队(吕伟/胡又文团队)最新研报指出,智谱新一代大模型GLM-5.3-Flash正从架构与系统层面对国产算力进行适配优化,成为观察国产大模型如何激活本土芯片的重要样本。
报告显示,GLM-5.3-Flash总参数量约320B,与上一代GLM-4.5的355B基本相当,但激活参数量由32B大幅压缩至18B,层数由92层减至45层。
架构层面,该模型采用线性注意力与稀疏注意力混合架构,稀疏注意力引入IndexPool索引器,将注意力计算的显存与带宽需求大幅压缩,缓解推理时的显存消耗与带宽压力。
报告认为,稀疏注意力与低激活参数已成为国产大模型优化的主要方向之一,多家头部模型厂商的新一代架构呈现出高度趋同的解法。
报告同时提及,DeepSeek-V4在token维度压缩上下文、结合DSA稀疏注意力,1M上下文成为全系服务标配,显示国产模型厂商正围绕算力效率展开竞赛。
值得关注的是,激活参数的压缩意味着推理时的显存占用与带宽压力显著下降,为国产芯片运行前沿模型提供了更友好的条件。这或许正是「全面激活国产算力」命题的落点所在。
后续看点在于GLM-5.3-Flash在国产算力集群上的实际推理表现、IndexPool稀疏注意力在长上下文下的扩展性,以及智谱后续模型的迭代节奏。
为什么重要
智谱以更激进的激活参数压缩与混合注意力架构推进国产算力适配,表明头部国产模型厂商正把算力效率作为与本土芯片协同的核心策略。
附近消息
全部08/30 09:56
关停五年后,虾米被阿里用AI“复活”了:AI音乐模型“快乐虾米”上线
阿里巴巴正式发布AI音乐模型HappyShrimp 1.0,中文名“快乐虾米”,国内外PC网页端同步上线,并在首日宣布与太合音乐集团达成战略合作。关停五年后,“虾米”以AI形态回归,主打自然语言交互生成整曲,但面对Mureka、Suno等已迭代多轮的对手,这张“入场券”能否转化为领先优势仍有待观察。
08/30 09:04
WSJ:Workday 财报利润与营收双增,AI Agent 采用成为重要驱动
据《华尔街日报》报道,企业云软件公司 Workday 最新财报显示利润与营收双双增长,AI Agent(智能体)的采用被列为重要推动因素。这标志着 AI 智能体正在从演示概念转化为企业软件的实际收入来源。
08/30 08:35
Notion扩展AI Agent能力与集成,生产力工具加速智能体化
据TipRanks报道,Notion正在扩展其AI Agent能力与集成,将智能体功能进一步嵌入团队协作与知识管理工作流。此举延续了Notion在AI产品上的持续投入,也反映出主流生产力软件正从生成式AI辅助转向自主智能体执行的新阶段。
08/30 06:07
外媒:SpaceX收购Cursor后,OpenAI切断其对自家模型的访问
据Gagadget.com报道,在SpaceX完成对Cursor的收购之后,OpenAI已切断这家AI编程助手对其模型的访问权限。这意味着Cursor用户将无法再通过该产品调用OpenAI的模型,事件也让AI编程工具与模型供应商之间的关系成为焦点。