游乐游手机版
首页/科技数码/文章详情

英伟达发布Vera CPU与Rubin GPU更多细节 大幅提升智能体AI性能

时间:2026-07-23 12:20
英伟达维拉鲁宾平台全面投产,鲁宾图形处理器采用台积电3nm工艺,集成3360亿晶体管,智能体AI性能较布莱克威尔提升10倍,配备224个流处理器与288GBHBM4内存。维拉中央处理器基于ARMv9架构,88核176线程,智能体AI负载性能为AMD霄龙9755的1 8倍。

GTC 2026重磅发布:英伟达Vera Rubin平台全面投产,7款新芯片细节深度解析

本届GTC大会最受瞩目的消息,莫过于英伟达创始人黄仁勋正式宣布Vera Rubin平台全面投产。该平台阵容强大,由Vera CPU、Rubin GPU、NVLink 6交换机、ConnectX-9 SuperNIC、BlueField-4 DPU、Spectrum-6以太网络交换机和Groq 3 LPU共7款新芯片组成。随着新一代基于Vera Rubin平台的机架开始大规模出货,英伟达也终于公开了Vera CPU和Rubin GPU的更多技术细节。


首先聚焦Rubin GPU。该芯片采用台积电3nm工艺(N3P),集成高达3360亿个晶体管,面向智能体AI的性能相比上一代Blackwell提升了整整10倍。它采用chiplet设计,两个达到光罩极限尺寸的计算芯片,通过英伟达自研的"NV-HBI(NVIDIA高带宽接口)"高速跨芯片互联链路连接在一个封装内。完整状态下,内部包含224个SM、896个Tensor Core,搭配288GB的HBM4。

根据英伟达公布的架构图,计算模块存在两种GPC,分别包含30个和26个SM。每个计算模块都配备四个GPC,连接L2缓存,提供四个HBM通道和一个NVLink接口。其中NVLink v6提供3600GB/s的GPU间互联带宽,NVLink-C2C接口提供1800GB/s的CPU与GPU间互联带宽,而PCIe Gen6 x16通道则提供256GB/s的连接带宽。这些数字意味着什么?简单来说,数据在芯片间的传输延迟极低,几乎可以忽略不计。


Vera CPU的设计思路同样明确:围绕智能体AI负载,重点优化满负载下的单线程性能。它采用基于Arm v9架构的"Olympus"核心,共有88个定制内核和176线程。每个核心配备了一个96KB的六路L1数据缓存和一个2MB的八路L2缓存,并增加了多种硬件预取机制,同时还集成了164MB的统一L3缓存。这套配置,显然是专门为AI推理场景量身定制的。

Vera CPU借助第二代可扩展相干互连技术,连接核心、缓存、内存控制器、I/O以及NVLink-C2C接口,提供最高3.4TB/s的核心间带宽。可搭配最多1.5TB的SOCAMM2 LPDDR5X内存,带宽达到1.2TB/s。NVLink-C2C接口带宽达1.8TB/s,另外还支持PCIe Gen6和CXL 3.1标准。双路配置下,总共提供176条PCIe通道。


最后,英伟达还给出了一个很有意思的对比数据:相较于AMD EPYC 9755处理器,Vera CPU在处理智能体AI负载时的性能表现达到了对手的1.8倍。在当前AI基础设施升级的关键时期,这一数据分量十足。

来源:https://www.163.com/dy/article/L2F7Q6RM05118EDB.html
上一篇上海AI实验室等机构证明:AI直接看论文原图比读文字更聪明 下一篇现代汽车高管剖析速成车乱象
本站内容用于信息整理与展示,如有侵权或内容问题请及时联系处理。

相关推荐

补充同频道和同主题内容,方便继续浏览更多相关内容。

同类最新

继续查看同栏目最近更新的文章。

更多
罗福莉入选新一届35岁以下科技创新35人中国区名单
科技数码 · 2026-07-25

罗福莉入选新一届35岁以下科技创新35人中国区名单

2025年《麻省理工科技评论》“35岁以下科技创新35人”中国区名单在上海发布,罗福莉、姚顺宇等入选。罗福莉推动大模型从“能聊天”走向“能干活”,探索智能体演进;姚顺宇建立非厄米拓扑能带理论。本届AI+机器人领域入选者占四成。

美国科技巨头为AI投资年内裁员近14万人
科技数码 · 2026-07-25

美国科技巨头为AI投资年内裁员近14万人

美国科技巨头年内裁员近14万人,同时计划在AI基础设施上投入7250亿美元。裁员主要目的为AI投资腾出资金并纠正疫情期间过度招聘,市场对AI相关裁员反应负面,而AI初创公司正加速扩招,形成对比。

位AI Infra高管复盘WAIC:暴力美学触顶后求变?
科技数码 · 2026-07-25

位AI Infra高管复盘WAIC:暴力美学触顶后求变?

WAIC2026上,AIInfra行业关注点从算力规模转向推理效率与Token产出。Agent驱动Token消耗激增,AI工厂与Token工厂成为关键载体。效率竞争取代规模竞赛,玩家分层加速,具备全栈优化能力的头部厂商优势凸显。

显卡厂商封仓引发涨价 玩家面临高价购买
科技数码 · 2026-07-25

显卡厂商封仓引发涨价 玩家面临高价购买

显卡市场,恐怕又要迎来一波涨价潮了。过去两年,不少玩家咬咬牙买下的高价显卡,如今回头看,竟然成了抄底。但问题在于,硬件市场每一次涨价,最终买单的永远还是玩家。 业内消息显示,GDDR7显存价格出现了明显上涨,单颗2GB显存价格上涨接近20美元。按8GB显存规格计算,一张显卡的显存成本或将增加约542

OpenAI加入签署AI开源模型公开信,组织达35家
科技数码 · 2026-07-25

OpenAI加入签署AI开源模型公开信,组织达35家

7月25日,微软、英伟达等25家美国公司联署公开信支持开放权重AI模型,随后签署方增至35家,新增包括OpenAI等。开放权重模型可下载、修改、运行,能扩大创新、强化竞争并降低风险,避免AI收益集中于少数巨头。