郭震 AI公众号:郭震AI

实时 AI 消息

阿里云真武M890超节点适配Qwen3.8,上线百炼提供推理服务

阿里真武M890超节点已成功适配参数规模达2.4万亿的Qwen3.8旗舰模型,并上线阿里云百炼平台提供推理服务,成为国内首个成功运行超2万亿参数大模型的超节点实例。该超节点通过64张真武M890芯片实现800GB/s高速互联,单实例即可支撑大规模MoE模型的专家并行需求。

发布时间

7月23日消息,阿里真武M890超节点已成功适配Qwen3.8,并上线阿里云百炼平台提供模型推理服务,这是国内首个成功运行超2万亿参数大模型的超节点实例。量子位率先报道了这一消息。

Qwen3.8是阿里最新旗舰模型,参数规模高达2.4万亿。运行如此规模的模型需要将参数分散到数十张甚至上百张高速互联的GPU卡上,让万亿参数实现高吞吐、低延迟的协同计算。然而,普通AI集群因通信带宽的局限,难以满足这一需求。

真武M890是平头哥新一代训推一体AI芯片,原生支持FP32到FP4等多种数据精度,可覆盖从高精度训练到超低精度推理的全场景。真武超节点通过ICN Switch 1.0互联芯片,将64张真武M890组成高速互联集群,实现800GB/s的芯片间通信带宽,显存规模达到9TB,单实例即可支撑2万亿参数MoE模型的专家并行计算。

在软件层面,阿里从芯片到云平台实现了与Qwen模型的全链路协同优化。这不仅使Qwen3.8能够丝滑运行在真武超节点上,还显著提升了推理效率并降低了推理成本。实测数据显示,通过算子优化和软硬件架构协同,该超节点实例在Agentic推理场景中最多可实现1.5倍的推理性能提升。

真武M890超节点适配Qwen3.8的意义在于,它展示了国产AI芯片生态正在快速成熟。平头哥芯片从早期聚焦训练场景,到如今在超大规模推理场景中实现商用落地,标志着国产AI硬件在高端市场迈出了关键一步。

对于阿里云而言,将真武超节点与百炼平台打通,也形成了从芯片到模型再到云服务的全栈闭环。这意味着阿里云不仅提供算力,还在芯片层、互联层和平台层进行了深度绑定,构建了更高的竞争壁垒。

随着Qwen3.8在百炼平台正式上线推理服务,企业用户现在可以直接调用这一国产超大规模模型,运行在国产芯片基础设施之上。这为国内大模型应用的规模化部署提供了一个具备自主可控能力的选项。

为什么重要

真武超节点成功运行2.4万亿参数模型,证明国产AI芯片已具备承载超大规模模型推理的能力,阿里云从芯片到模型的全栈闭环正在改变国内AI基础设施竞争格局。

微博邮件

阿里云平头哥真武芯片Qwen3.8百炼AI基础设施
返回实时消息

附近消息

全部