2025年7月20日,中国信通院正式发布了一项备受行业关注的消息——依托位于北京经开区国家信创园的人工智能软硬件协同创新与适配验证中心,基于AISHPerf人工智能软硬件基准体系,全面启动了“AISHPerf大模型训推工程实践性能基准研究工作”。
这项工作的核心方向可概括为三个关键词:建基准、聚数据、促优化。具体而言,它将聚焦千卡至万卡规模集群在训练与推理环节中的核心性能瓶颈,系统性地梳理模型算力利用率、显存利用率、线性扩展效率、有效训练时间占比、首词元时延、吞吐量、显存带宽利用率等关键指标的定义口径与经验值区间。同时,结合业界公开的技术报告与实测数据,最终为行业提供一套可引用、可对标、可追溯的工程性能参考基准。这正是推动可信智算体系规范化发展的关键一步。
简而言之,过去在开展大模型训练与推理时,性能水平往往依赖各自内部对比或经验判断,缺乏统一的衡量标准。如今,这套基准体系的建立,使得不同厂商、不同集群之间的性能差异能够用同一把“尺子”进行量化评估,短板所在与优化空间一目了然。对于整个行业而言,这相当于为智算领域装上了一块“标准仪表盘”。

