发生了什么
阿里云旗下平头哥半导体宣布,其新一代训推一体AI芯片真武M890已完成超节点部署,并在阿里云百炼平台成功适配Qwen3.8-2.4T大模型,正式对外提供推理服务。这是国内首次在完全自研的AI芯片集群上跑通2.4万亿参数MoE(混合专家)模型的专家并行推理。
技术架构与关键参数
真武M890是平头哥推出的新一代AI芯片,原生支持从FP32到FP4的全精度计算。本次部署的超节点通过平头哥自研的ICN Switch 1.0互联芯片,将64颗M890以800GB/s的带宽高速互联,总显存规模达到9TB。这一显存容量足以完整承载2.4万亿参数MoE模型的所有专家网络,无需进行模型压缩或量化降级。
- 芯片型号:真武M890,平头哥新一代训推一体AI芯片
- 计算精度:原生支持FP32至FP4全精度范围
- 互联方案:ICN Switch 1.0芯片,64颗M890实现800GB/s互联
- 显存规模:单超节点达9TB
- 部署平台:阿里云百炼,已对外开放推理API
为什么重要
超大规模MoE模型的推理长期以来依赖英伟达高端GPU集群,国产芯片受限于单卡显存和互联带宽,难以支撑万亿参数级模型的实时推理。真武M890超节点的成功部署,证明国产AI芯片通过自研互联方案可以突破单卡性能瓶颈,在超大规模模型场景中形成替代能力。对于关注国产算力自主可控的企业用户而言,这一进展意味着百炼平台已经具备了从训练到推理的完整国产芯片服务链条,降低了对外部高端芯片的依赖风险。

