最近,一则消息引发行业关注:中国电信正计划在上海建设一个国产超大规模算力液冷集群。这并非普通的机房扩容,而是直接面向万亿参数级别的大模型训练需求——单池新建国产算力达到10000卡,并且首次在国产集群中全面采用液冷技术。这意味着,该集群将成为国内首个支持单池万卡的国产超大规模算力液冷集群。

从行业视角来看,这一布局释放出两个关键信号。其一,国产算力正从“能用”迈向“好用”乃至“规模化”——万卡集群意味着实际训练效率可以大幅提升,而不再只是实验室里的数字游戏。其二,液冷技术的规模化应用,表明行业已意识到传统风冷在超高密度场景下的瓶颈:单卡功耗持续攀升,散热跟不上,算力便难以释放。液冷不仅是“降温方案”,更是支撑千卡、万卡集群稳定运行的底层基础设施。
当然,万亿参数大模型的训练对网络、存储、调度都提出了极高的协同要求。单池万卡只是第一步,后续能否真正发挥出算力池的整体效能,还需看整体架构设计是否经得起实际业务的考验。但无论如何,中国电信这步棋,已经为国产算力集群的“万卡时代”拉开了序幕。
