实时 AI 消息
贾扬清再创业:打造 AI 加速军团,让 GLM-5.2 推理提速 534%
Caffe 创始人、前阿里巴巴 VP 贾扬清再度创业,组建了一支 AI 优化团队,成功将智谱 GLM-5.2 大模型的推理速度提升 534%。这标志着中国 AI 推理优化领域迎来了一位重量级选手。
据新浪新闻报道,著名 AI 框架 Caffe 的创始人、前阿里巴巴副总裁、前 Lepton AI 创始人贾扬清再次踏上创业征程。他组建了一支 AI 优化团队,在模型推理加速领域取得了令人瞩目的成果——将智谱 AI 的 GLM-5.2 大模型推理速度提升 534%。
贾扬清是 AI 领域公认的技术领袖。他早年创建了深度学习框架 Caffe,后加入 Facebook 领导 AI 基础设施团队,随后回国加入阿里巴巴担任副总裁,主导了阿里云 AI 平台的建设。2023 年,他创办了 Lepton AI,一家致力于简化 AI 应用部署的云平台公司。2025 年,Lepton AI 被 NVIDIA 收购,贾扬清加入 NVIDIA 担任系统软件副总裁。
如今,贾扬清再度创业,组建了一支被称为“AI 军团”的优化团队。虽然目前关于这支团队的具体规模、核心成员以及公司名称等信息尚未完全披露,但其取得的 534% 推理加速成果已经引起了行业的高度关注。
GLM-5.2 是智谱 AI 推出的最新一代大语言模型,在国内大模型市场中占据重要地位。能够在保持模型质量的前提下实现超过 5 倍的推理速度提升,这对于降低模型部署成本、提升用户体验具有重要意义。推理加速直接关系到企业的 API 服务成本,对于推动大模型在生产环境中的大规模落地尤为关键。
这一事件传递了多重信号。首先,推理优化正在成为中国 AI 产业的下一个技术高地。随着基础模型能力日趋成熟,如何让模型跑得更快、成本更低,成为决定商业化成败的关键因素。其次,贾扬清这位堪称传奇的技术领袖再次选择创业,说明中国 AI 推理优化领域仍然存在巨大的创新空间和市场机会。
值得关注的是,贾扬清此次选择以 GLM-5.2 而非国外模型作为展示案例,凸显了中国国产大模型生态正在形成自己的技术闭环。从模型训练到推理优化,中国 AI 产业链正在快速完善。后续需要关注贾扬清新公司的具体定位、融资情况以及是否会推出面向市场的推理优化产品。
为什么重要
贾扬清再度创业并实现 GLM-5.2 推理 534% 的加速,标志着中国 AI 推理优化赛道迎来了顶级技术力量,国产大模型生态的技术闭环正在加速形成。
附近消息
全部07/30 05:16
AI动态:Discover what’s next for AI, from the SaaS reckoning to the agent security gap, at TechCrunch Disrupt 2026
据 techcrunch.com 消息,Discover what’s next for AI, from the SaaS reckoning to the agent security gap, at TechCrunch Disrupt 2026。At TechCrunch Disrupt 2026, the AI Stage is back to dig into the single hottest topic in the community for the past few years, presented by Google for Startups.
07/30 06:23
Zuckerberg:Meta的企业AI机会远超AI智能体,涵盖API、算力销售和内部工具
Meta CEO马克·扎克伯格在第二季度财报电话会议上表示,Meta看到了远超AI智能体的"大型企业机会",涵盖API、企业智能体、算力直销和内部生产力工具。他同时透露,Meta正在构建编码、开发和内部生产力工具,未来将向外开放给企业客户。
07/30 05:07
Thinking Machines 联合创始人翁丽莲因健康原因离职,随即重返 OpenAI
翁丽莲(Lilian Weng)本周宣布因健康原因辞去 Thinking Machines 联合创始人职务,随即被 OpenAI 重新聘用,领导一支专注于加速内部研究的前沿团队。这一高调的人事变动引发行业对 AI 人才争夺白热化程度的关注。
07/30 06:35
Tether Data 发布 4.6 亿参数视觉模型,推动 AI 从云端走向设备端
稳定币发行商 Tether 旗下的 AI 部门 Tether Data 发布了一款 4.6 亿参数的视觉模型,主打在设备端本地运行、无需依赖云端推理。这一举措标志着加密货币巨头向 AI 领域的拓展进入了产品化阶段。