从整个行业的角度来看,Vera Rubin 的部署不仅仅是英伟达下一代产品的落地,更是在为 Agentic AI 时代的算力需求打基础。当推理模型成为主流,当每一个智能体都在实时交互,算力的效率就成了绕不开的课题。Vera Rubin 在这个时间点的出现,恰好卡在了关键节点上。DeepSeek R1推理实测:英伟达Vera Rubin吞吐量提升10倍
近日,英伟达VeraRubinNVL72正加速量产,已在全球30个国家部署了超过350个工厂。CoreWeave完成了首次上电验证,基于DeepSeekR1的测试结果显示,每兆瓦token的吞吐量较GB200NVL72提升了10倍,为AgenticAI时代的算力效率奠定了坚实基础,这标志着AI算力效率的重大突破。
英伟达于7月21日发布了一条重磅消息:Vera Rubin 正在迈入万亿级规模部署阶段。这一动态在行业内掀起了巨大波澜——因为这不仅是技术迭代,更标志着整个 AI 基础设施的格局正在被重新定义。
英伟达在官方博文中明确表示,Vera Rubin NVL72 的量产正在加速推进,并已在 CoreWeave、Google Cloud、Microsoft Azure 和 Oracle Cloud Infrastructure 等合作伙伴的系统中实际运行。可以说,英伟达这次是动真格了——为了满足全球客户日益增长的计算需求,Vera Rubin 在 30 个国家部署了超过 350 个工厂,建立了有史以来规模最大、最成熟的机架级供应链。这才是关键所在:在算力军备竞赛中,供应链的成熟度往往决定了技术能走多远。
就在同一天,CoreWeave 也发布了一则消息,透露该公司早在 6 月初就完成了业界首个 Vera Rubin NVL72 的上电和验证工作。他们搭建了一套端到端的机架级系统,电力、散热、网络、计算全部跑通,并已进入稳定运行状态。这可不是实验室里的演示,而是实实在在的商用部署。
更有意思的是,CoreWeave 还基于 DeepSeek R1 做了对比测试。DeepSeek R1 是目前驱动智能体 AI(Agentic AI)爆发式增长的核心推理模型之一,选择它来做测试,本身就很有说服力。测试的重点落在了两个指标上:每兆瓦的 token 吞吐量,以及交互性(TPS/user,反映用户或智能体在模型处理任务时感受到的响应速度)。在保持交互性目标一致的前提下,Vera Rubin NVL72 在相同的 DeepSeek R1 工作负载下,每兆瓦的 token 吞吐量比 GB200 NVL72 提升了整整 10 倍。这个数字意味着什么?意味着同样的电力消耗,能支撑起 10 倍的推理任务——在 AI 应用大规模落地、电力成本日益敏感的当下,这几乎是一个决定性的优势。
从整个行业的角度来看,Vera Rubin 的部署不仅仅是英伟达下一代产品的落地,更是在为 Agentic AI 时代的算力需求打基础。当推理模型成为主流,当每一个智能体都在实时交互,算力的效率就成了绕不开的课题。Vera Rubin 在这个时间点的出现,恰好卡在了关键节点上。
从整个行业的角度来看,Vera Rubin 的部署不仅仅是英伟达下一代产品的落地,更是在为 Agentic AI 时代的算力需求打基础。当推理模型成为主流,当每一个智能体都在实时交互,算力的效率就成了绕不开的课题。Vera Rubin 在这个时间点的出现,恰好卡在了关键节点上。来源:https://www.163.com/dy/article/L2E5L2H70511B8LM.html
本站内容用于信息整理与展示,如有侵权或内容问题请及时联系处理。
相关推荐
补充同频道和同主题内容,方便继续浏览更多相关内容。
同类最新
继续查看同栏目最近更新的文章。
罗福莉入选新一届35岁以下科技创新35人中国区名单
2025年《麻省理工科技评论》“35岁以下科技创新35人”中国区名单在上海发布,罗福莉、姚顺宇等入选。罗福莉推动大模型从“能聊天”走向“能干活”,探索智能体演进;姚顺宇建立非厄米拓扑能带理论。本届AI+机器人领域入选者占四成。
美国科技巨头为AI投资年内裁员近14万人
美国科技巨头年内裁员近14万人,同时计划在AI基础设施上投入7250亿美元。裁员主要目的为AI投资腾出资金并纠正疫情期间过度招聘,市场对AI相关裁员反应负面,而AI初创公司正加速扩招,形成对比。
位AI Infra高管复盘WAIC:暴力美学触顶后求变?
WAIC2026上,AIInfra行业关注点从算力规模转向推理效率与Token产出。Agent驱动Token消耗激增,AI工厂与Token工厂成为关键载体。效率竞争取代规模竞赛,玩家分层加速,具备全栈优化能力的头部厂商优势凸显。
显卡厂商封仓引发涨价 玩家面临高价购买
显卡市场,恐怕又要迎来一波涨价潮了。过去两年,不少玩家咬咬牙买下的高价显卡,如今回头看,竟然成了抄底。但问题在于,硬件市场每一次涨价,最终买单的永远还是玩家。 业内消息显示,GDDR7显存价格出现了明显上涨,单颗2GB显存价格上涨接近20美元。按8GB显存规格计算,一张显卡的显存成本或将增加约542
OpenAI加入签署AI开源模型公开信,组织达35家
7月25日,微软、英伟达等25家美国公司联署公开信支持开放权重AI模型,随后签署方增至35家,新增包括OpenAI等。开放权重模型可下载、修改、运行,能扩大创新、强化竞争并降低风险,避免AI收益集中于少数巨头。
