7月23日,重磅消息传来:阿里真武M890超节点成功适配Qwen3.8,现已正式登陆阿里云百炼平台,提供高效模型推理服务。这不仅是简单的适配——作为国内首个支持超2万亿参数大模型运行的超节点,它标志着算力领域的重要里程碑。

Qwen3.8作为阿里最新的旗舰大模型,参数规模高达2.4万亿。要稳定运行如此庞大的模型,必须将参数分散到数十甚至上百张高速互联的GPU卡上,同时确保高吞吐、低延迟、高并发。然而,传统AI集群的通信带宽难以满足这些严苛要求,暴露出架构瓶颈。
如何解决?真武M890给出了答案。这款由平头哥推出的新一代训推一体AI芯片,原生支持FP32至FP4等多种数据精度,全面覆盖高精度训练与低精度、超低精度推理场景。关键在于,真武超节点实例通过ICN Switch 1.0互联芯片,将64张M890芯片串联,实现800GB/s高速互联,显存规模高达9TB。单实例即可支撑大规模2万亿参数MoE模型的专家并行需求——相当于将一座超级计算中心整合进单一实例中。
仅有硬件堆料还不够,阿里从芯片到云平台层面,对Qwen模型进行了全链路优化。最终不仅实现了Qwen3.8的流畅运行,还大幅提升了推理效率并降低了成本。实测数据表明:通过算子优化与软硬件架构协同,该超节点实例在Agentic推理场景中,最高可带来1.5倍的推理性能提升。换言之,相同任务下,运行速度更快,成本更低。
