近日,华东地区(杭州)首个国产TPU智算千卡集群正式建成投产。该项目由中昊芯英、杭州电信、中兴通讯三方联合打造,一期算力规模达到400P——这意味着每秒可完成400,000万亿次计算,为AI训练与推理提供了强劲的算力底座。
这一时间节点的选择颇具深意。词元经济正深刻改变算力市场的游戏规则,算力价值的衡量标准不再局限于硬件参数,而是转向“卖Token”模式。用户的关注点已从“我这台机器有多少核心”变为“购买一个Token需要多少成本,产出效率是否足够高”。在这一新尺度下,同等算力条件下,功耗越低越能节省电费支出;集群利用率越高,越能利用相同硬件产出更多可计费词元,从而提升整体经济效益。
该千卡集群的实际表现令人瞩目。其AI算力性能直接超越海外同类产品近1.5倍,同时能耗降低了30%。更值得关注的是集群利用率——杭州电信“息壤”算力平台将资源利用率从30%拉升至60%以上。利用率实现翻倍,意味着可售算力同步翻倍,这才是真正的商业价值释放。
基于一期项目的显著成效,二期扩容已在规划推进中。按照部署,未来该集群将能够承载万亿参数大模型的分布式训练、多智能体协同运算,以及全平台海量Token并发推理等高负载业务场景。这并非小规模试验,而是面向真实商用需求的大规模落地实践。
运营模式的变化同样值得深思。今年5月,三大运营商相继推出词元套餐。中国电信率先发布了9.9元/月1000万词元的套餐——算力首次拥有了清晰的“价签”。杭州电信正积极推动算力从“资源”向“服务”的升级转型。其“智云杭州AI Store”平台已整合天翼云算力池与本地国产异构算力池,汇聚多家主流大模型。企业无需再分别注册多套协议,即可直接获取算力服务,接入门槛显著降低。
据透露,中国电信杭州智算中心单日Token处理规模已达到千亿级。这意味着国产TPU算力不仅“跑起来了”,更进入了大规模商用交付节奏。运营商对集群的稳定性、可用性及运维效率要求远高于一般场景。该千卡集群的顺利落成,表明国产TPU集群已成功通过运营商级的压力测试,具备了高可靠性的商用能力。
词元经济的到来重新定义了算力的价值尺度,运营商的采购决策也因此变得更加务实。这一智算千卡集群的落成,不仅是一个项目的阶段性成果,更标志着国产TPU大规模集群在真实商用场景中,已具备稳定性和经济性,为国产算力产业的未来发展奠定了坚实基础。
