7月23日,阿里云再次迎来重磅发布——真武M890超节点已成功完成与Qwen3.8的适配,并正式在阿里云百炼平台上线,提供高效模型推理服务。这一节点并非普通集群,它是国内首个能够支撑超2万亿参数大模型运行的超节点,从某种意义上说,标志着一次重要的技术突破。

Qwen3.8是阿里最新旗舰级大模型,参数规模高达2.4万亿。要将如此庞大的参数拆解并分配到数十甚至上百张高速互联的GPU卡上协同计算,才能使这个“巨无霸”实现稳定且高效的运行。然而,传统AI集群大多受限于通信带宽,面对高吞吐、低延迟、高并发的严苛需求,往往难以胜任。
真武M890是平头哥推出的新一代训推一体AI芯片。它原生支持从FP32到FP4等多种数据精度,可覆盖高精度训练、低精度推理乃至超低精度推理的全场景需求。在真武超节点实例中,借助ICN Switch 1.0互联芯片,64张真武M890实现了800GB/s的高速互联,显存规模直接达到9TB。换句话说,单实例即可支撑起大规模2万亿参数MoE模型的专家并行需求,这在过去难以想象。
更关键的是,阿里从芯片到云平台层面与Qwen模型进行了全链路深度优化。这不仅能够顺畅运行Qwen3.8,还能显著提升推理效率并降低推理成本。实测数据显示:通过算子优化与软硬件架构协同,在Agentic推理场景中,该超节点实例最多可实现1.5倍的推理性能提升。对于大规模部署而言,这一数字意味着实实在在的成本节省。
