2026世界人工智能大会(WAIC)在上海盛大开幕。作为国内屈指可数具备全栈GPU研发与交付能力的领先企业,摩尔线程在本次大会上交出了一份亮眼的答卷——以“词元时代 万物智能”为主题,首次同步启用上海世博展览馆与张江科学会堂两大展区,全方位展示了“模型训练工厂、词元生产工厂、智能体生产工厂”三大AI核心基础设施。展会期间,摩尔线程还首次面向公众发布了自主研发的MTT C256超节点,为万卡级乃至十万卡级智能计算中心提供了全新的系统级架构与高性能算力底座。
当前大模型参数规模已突破万亿级别,传统智算网络架构正面临一个棘手难题——多层级交换引发的带宽衰减和通信时延日益严重。摩尔线程此次推出的MTT C256超节点,采用“计算+交换”深度融合的一体化高密度设计,实现了技术跃迁:单层Scale-up网络可直连的GPU数量,从行业主流的64卡直接跃升至256卡。
具体而言,该超节点在标准单宽机柜内即可实现128卡全互联,通过并柜部署可扩展至256卡极速互联。传统多层网络架构下带宽损失严重、延迟高企的顽疾,在此被彻底攻克。GPU间通信延迟被压缩至亚微秒级别,整体带宽利用率显著提升,为大模型分布式训练策略的深度优化开辟了更广阔的空间。

MTT C256超节点拥有三大核心能力:
超低时延互联:打破业内一层网络64卡互联的常规上限,在单一Scale-up网络内首次实现256卡全直连,卡间通信延迟稳定控制在亚微秒级别。
超高密度集成:单机柜GPU部署密度显著领先行业,仅需两个标准2U机柜即可构建256卡一层Scale-up高速互联集群,在提升算力密度的同时,大幅缩减数据中心物理空间占用。
开放兼容演进:基于2U紧凑型节点设计,无缝适配当前主流智算软硬件生态体系,支撑智算集群从万卡规模向十万卡级别平滑升级与弹性扩展。

MTT C256超节点精准适配以下三类核心智算任务:
大模型训练:作为十万卡级集群的关键单元,全面支持大模型预训练、指令微调(SFT)、强化学习(RLHF)等全流程训练任务。
大规模推理:原生适配MoE稀疏架构及百万级超长上下文推理场景,兼具毫秒级响应与高并发吞吐能力。
实时推理解码:面向高并发交互式应用,单用户token生成速率突破100 token/s,可高效支撑AI编程(AI Coding)等对低延迟与强实时性要求严苛的前沿场景。
