导语:7月23日,阿里云宣布其灵骏真武 M890 超节点实例已成功适配 Qwen3.8,并上线百炼平台提供模型推理服务,成为国内首个成功运行超2万亿参数大模型的超节点。
摘要:
7月23日,阿里云宣布其灵骏真武 M890 超节点实例已成功适配 Qwen3.8,并上线百炼平台提供模型推理服务,成为国内首个成功运行超2万亿参数大模型的超节点。Qwen3.8 是阿里最新旗舰模型,参数规模达2.4万亿,运行该量级模型需要把参数分布到数十甚至上百张高速互连的加速卡上。真武 M890 是平头哥新一代训推一体 AI 芯片,原生支持从 FP32 到 FP4 的多种数据精度,可覆盖高精度训练到超低精度推理等多种场景。真武超节点实例采用 ICN Switch 1.0 互连芯片,使64颗真武 M890 芯片实现800GB/s 高速互连,总显存达9TB,单实例即可支撑2万亿参数规模 MoE 模型的专家并行。
正文:
IT之家 7 月 23 日消息,今日,阿里云宣布灵骏真武 M890 超节点实例已成功适配 Qwen3.8,并上线阿里云百炼平台提供模型推理服务,这是国内首个成功运行超 2 万亿参数大模型的超节点。
据介绍,Qwen3.8 是阿里最新旗舰模型,参数规模高达 2.4 万亿,跑通这一规模的模型需要将参数分散到几十张甚至上百张高速互联的 GPU 卡,让万亿参数“跑得又稳又快”。然而,普通 AI 集群因通信带宽的局限,无法满足高吞吐、低延迟、高并发的需求。
IT之家注意到,真武 M890 是平头哥新一代训推一体 AI 芯片,原生支持 FP32 到 FP4 等多种数据精度,可应用于高精度训练、低精度和超低精度推理的全场景。灵骏真武 M890 超节点实例通过 ICN Switch 1.0 互联芯片,让 64 张真武 M890 实现了 800GB/s 的高速互联,显存规模达到 9TB,单实例即可支撑大规模 2 万亿参数 MoE 模型的专家并行需求。
此外,阿里还从芯片到云平台层面实现了与 Qwen 模型的全链路优化,不仅可以丝滑跑通 Qwen3.8,还能显著提升推理效率、降低推理成本。实测数据显示,通过算子优化和软硬件架构协同,该超节点实例在 Agentic 推理场景中最多可实现 1.5 倍的推理性能提升。

扫一扫,或长按识别二维码
关注艾瑞网官方微信公众号