首先来看几项关键数据:在真实生产环境中的智能体AI(Agentic AI)负载测试里,英伟达Vera CPU的表现十分亮眼,处理速度直接超越竞争对手一倍以上。
云端AI推理平台DeepInfra于7月21日发布了一份测试报告,详细对比了英伟达Vera CPU与其他主流处理器在智能体AI场景下的实际性能。此前英伟达官方曾表示,Vera相比AMD的Turin 9755,在处理此类负载时性能提升高达80%。而此次第三方实测结果更加直观——Vera的runc延迟仅为29毫秒,相比之下,英特尔Sapphire Rapids为64毫秒。计算下来,Vera的速度快了整整2.2倍。

那么,测试环境是如何设定的?为确保公平性,所有测试均在统一条件下进行:每次运行均采用20个物理核心、每核心1线程、单NUMA节点,并启用了CPU confinement机制,超核预算的任务会被直接丢弃。这样的设置使得测试结果极具说服力。

图源:deepinfra
若将所有芯片的测试数据汇总对比,差距则更为显著。下方表格浓缩了本次测试的核心结果:
芯片Kata ms (deployed)runc ms (intrinsic)IPCNVIDIA Vera58293.62AMD Zen5 Turin8735—Intel Granite Rapids103512.44Intel Sapphire Rapids122642.44
从数据来看,Vera不仅在runc延迟上遥遥领先,其IPC(每时钟周期指令数)也达到了3.62,明显高于英特尔的两款产品。这意味着什么?意味着在实际生产环境中,Vera能够以更快的速度响应请求,吞吐能力也更为出色。
当然,这并非终点。随着智能体AI负载日益复杂,CPU的瓶颈将愈发凸显。Vera此次的表现,至少表明英伟达在CPU领域已经开始认真发力了。
