实时 AI 消息
贾扬清再创业:打造 AI 加速军团,让 GLM-5.2 推理提速 534%
Caffe 创始人、前阿里巴巴 VP 贾扬清再度创业,组建了一支 AI 优化团队,成功将智谱 GLM-5.2 大模型的推理速度提升 534%。这标志着中国 AI 推理优化领域迎来了一位重量级选手。
据新浪新闻报道,著名 AI 框架 Caffe 的创始人、前阿里巴巴副总裁、前 Lepton AI 创始人贾扬清再次踏上创业征程。他组建了一支 AI 优化团队,在模型推理加速领域取得了令人瞩目的成果——将智谱 AI 的 GLM-5.2 大模型推理速度提升 534%。
贾扬清是 AI 领域公认的技术领袖。他早年创建了深度学习框架 Caffe,后加入 Facebook 领导 AI 基础设施团队,随后回国加入阿里巴巴担任副总裁,主导了阿里云 AI 平台的建设。2023 年,他创办了 Lepton AI,一家致力于简化 AI 应用部署的云平台公司。2025 年,Lepton AI 被 NVIDIA 收购,贾扬清加入 NVIDIA 担任系统软件副总裁。
如今,贾扬清再度创业,组建了一支被称为“AI 军团”的优化团队。虽然目前关于这支团队的具体规模、核心成员以及公司名称等信息尚未完全披露,但其取得的 534% 推理加速成果已经引起了行业的高度关注。
GLM-5.2 是智谱 AI 推出的最新一代大语言模型,在国内大模型市场中占据重要地位。能够在保持模型质量的前提下实现超过 5 倍的推理速度提升,这对于降低模型部署成本、提升用户体验具有重要意义。推理加速直接关系到企业的 API 服务成本,对于推动大模型在生产环境中的大规模落地尤为关键。
这一事件传递了多重信号。首先,推理优化正在成为中国 AI 产业的下一个技术高地。随着基础模型能力日趋成熟,如何让模型跑得更快、成本更低,成为决定商业化成败的关键因素。其次,贾扬清这位堪称传奇的技术领袖再次选择创业,说明中国 AI 推理优化领域仍然存在巨大的创新空间和市场机会。
值得关注的是,贾扬清此次选择以 GLM-5.2 而非国外模型作为展示案例,凸显了中国国产大模型生态正在形成自己的技术闭环。从模型训练到推理优化,中国 AI 产业链正在快速完善。后续需要关注贾扬清新公司的具体定位、融资情况以及是否会推出面向市场的推理优化产品。
为什么重要
贾扬清再度创业并实现 GLM-5.2 推理 534% 的加速,标志着中国 AI 推理优化赛道迎来了顶级技术力量,国产大模型生态的技术闭环正在加速形成。
附近消息
全部07/30 05:07
Thinking Machines 联合创始人翁丽莲因健康原因离职,随即重返 OpenAI
翁丽莲(Lilian Weng)本周宣布因健康原因辞去 Thinking Machines 联合创始人职务,随即被 OpenAI 重新聘用,领导一支专注于加速内部研究的前沿团队。这一高调的人事变动引发行业对 AI 人才争夺白热化程度的关注。
07/30 06:35
Tether Data 发布 4.6 亿参数视觉模型,推动 AI 从云端走向设备端
稳定币发行商 Tether 旗下的 AI 部门 Tether Data 发布了一款 4.6 亿参数的视觉模型,主打在设备端本地运行、无需依赖云端推理。这一举措标志着加密货币巨头向 AI 领域的拓展进入了产品化阶段。
07/30 04:52
OpenAI推出科学家免费AI访问计划,模型权重仍不开放
OpenAI宣布启动面向科研人员的免费AI模型访问计划,科学家可通过申请获得API使用权限。但报道明确指出,模型权重仍然不对外开放,OpenAI保留对模型底层的完全控制。
07/30 06:46
微软财报披露:Anthropic 投资带来 32 亿美元回报,OpenAI 表现喜忧参半
微软在 2026 财年第四季度财报中披露,其对 Anthropic 的投资已录得 32 亿美元回报,而对 OpenAI 的投资则表现参差不齐。这一财务细节揭示了微软同时押注两家竞争性 AI 实验室的复杂投资格局。