实时 AI 消息
中诚华隆发布HL200推理芯片及超节点集群:国产推理算力迈向万卡体系化时代
中诚华隆在北京举办2026 GPU新品发布会,正式推出二代HL200推理芯片与超节点智算集群方案,实现国产AI推理算力从单点芯片到万卡级集群的体系化升级。芯片单卡FP8算力达2P、FP4算力达4P,集群横向扩展最高可达10240卡,全面覆盖8卡至万卡部署场景。
8月24日消息,中诚华隆2026 GPU新品发布会近日在北京举办,正式推出全新HL200推理芯片及超节点智算集群方案,宣称实现国产AI推理算力从单点芯片突破到万卡级集群体系化协同的跨越式升级。工业和信息化部电子信息科技委执行副主任兼秘书长毕开春、中国科技咨询协会理事长刘志光出席活动并致辞。
当前AI产业正加速从训练驱动转向推理驱动,随着AI Agent规模化落地、长上下文交互与多轮对话场景普及,行业Token消耗快速攀升,超长上下文高效、低时延推理能力成为算力赛道的核心竞争壁垒。中诚华隆延续“一年一芯”迭代节奏,基于前代芯片技术积淀推出二代HL200推理芯片,精准适配生成式AI与AI Agent高并发推理场景。
规格方面,HL200原生支持FP4、FP8超低精度推理,并兼容主流FP16精度。官方数据显示,芯片单卡FP16/BF16算力为0.5P、FP8算力2P、FP4算力4P,能效比达5.12 TFLOPS/W,称稳居国内第一梯队。生态层面,HL200全面兼容PyTorch、ONNX、vLLM等主流技术栈,配套OpenAI兼容接口与轻量化迁移方案,以降低企业模型迁移与业务切换成本。
在适配测试中,HL200在DeepSeek V4 Flash、DeepSeek V4 Pro、GLM 5.2等主流大模型的对标测试中,相较国际同级芯片Prefill全流程性能全面领先,模型解码延迟优势显著,可稳定支撑大模型规模化、高时效商业推理部署。
集群方面,中诚华隆同步发布HL200超节点智算集群方案:单机柜支持64张GPU高速互联,单节点最高可实现1024卡纵向堆叠,横向扩展最高可达10240卡,全面覆盖8卡至万卡全场景算力部署需求。集群通过算、存、网全链路SLO协同优化,在算力密度、互联带宽、部署时延、能效表现等关键指标达到业界先进水平。
会上,中诚华隆与中国能建所属中电工程、浪潮信息、紫光智算、光环云等十余家行业龙头企业达成战略合作,共建开放共赢、自主可控的国产AI算力产业生态。中诚华隆董事长王嘉诚博士表示,行业算力竞争已告别单纯参数比拼,进入推理效率、落地体验、产业价值的综合比拼阶段。
官方介绍,中诚华隆是国内少数具备“芯片+整机+解决方案”全栈自主可控能力的科技企业,已形成GPU、CPU多芯协同技术布局,核心产品已中标中国移动、中国电信等头部运营商,以及全国20余省份、近50个重点标段,深度服务政务、金融、能源、交通等国家关键信息基础设施领域。
本次发布被官方视为国产推理算力从单点技术突破迈向芯片、整机、集群、生态体系化协同的标志性节点。下一步值得关注的是HL200的规模化商用节奏、在运营商与政企市场的落地进展,以及国产推理芯片在能效与生态适配上的持续追赶。
为什么重要
HL200与超节点集群的发布意味着国产推理算力从单点芯片走向万卡级体系化供给,将加剧国产推理芯片在能效、生态与规模化部署上的竞争,也为万亿参数大模型商业化落地提供新的自主算力选项。
附近消息
全部08/24 14:51
机器人产业的“安卓时刻”:达塔机器人发布海叡云脑6.0与太始OS 1.0操作系统
8月24日,达塔机器人发布海叡云脑6.0与太始OS 1.0操作系统,该公司此前完成30亿元种子轮融资,是中国最大的种子轮科技公司。报道将这一发布称为机器人产业的“安卓时刻”,意味着机器人软件栈正走向标准化。
08/24 15:51
用友网络发布2026年半年报:企业AI进入规模化落地阶段
用友网络发布2026年半年度报告,明确提出企业AI已进入规模化落地阶段。这一信号意味着企业级AI应用正从单点试点走向覆盖核心业务环节的系统性部署,企业软件的智能化竞争进入新阶段。
08/24 15:54
英伟达洽谈投资Perplexity,估值或超300亿美元
据The Information报道,英伟达正在洽谈以超过300亿美元的估值投资AI搜索公司Perplexity,较一年前的200亿美元估值高出逾50%。该公司年化收入已从年初的不到2.5亿美元增长至超过7.5亿美元,云端AI代理产品Perplexity Computer是重要增长引擎。
08/24 13:35
美光CEO:AI内存需求看不到尽头
美光科技CEO公开表示,人工智能带来的内存需求看不到尽头,看好AI热潮下的芯片行业前景。这番表态正值市场关注AI算力扩张对内存供需格局的深远影响。