近期,美国针对中国高端人工智能芯片的出口管制政策出现了新的变化。其中,英伟达基于Hopper架构的H200计算卡已经获得对华出口许可,这在一定程度上缓解了国内部分AI研发企业的算力紧张问题。不过,从整个行业发展来看,这一进展更多只是满足了部分存量需求,面向未来AI推理场景的下一代产品能否获批进入中国市场,仍然是市场高度关注的核心问题。

此次获准出口的H200显卡,主要应用于AI大模型训练场景。根据行业消息,首批出口许可可能覆盖至少10家国内企业,潜在出货量预计达到75万块。这一消息无疑为国内大模型训练和AI研发带来了重要的硬件支撑。不过,从技术演进和产品迭代角度来看,H200所采用的Hopper架构,较英伟达当前重点推进的Blackwell架构以及后续规划中的Rubin架构,至少已经落后两代。
定制版B30A的性能规格与市场定位
事实上,为了满足美国出口管制要求,英伟达早已开始开发符合性能上限的定制化AI芯片产品。其中,基于Blackwell架构打造的B30A计算卡就是其中的重要产品。该型号自去年底起已向国内客户提供样卡测试。与面向全球市场推出的满配版Blackwell B200/B300双芯方案不同,B30A采用单芯设计,整体规模和配置均有所精简。
从具体性能规格来看,B30A的理论峰值性能(TPP)预计由完整版约60000 PFLOPS降至约30000 PFLOPS。显存配置方面,所搭载的HBM3e容量从192-288GB缩减至96-144GB,显存带宽也由8TB/s下调至4TB/s。虽然核心参数大致减半,但B30A依然保留了Blackwell架构的关键技术特征,例如支持FP4数据格式,同时其架构设计专门面向AI推理任务进行了优化。
推理市场需求与国产芯片的竞合关系
这使得B30A与更偏重模型训练任务的H200形成了差异化互补关系,而不是简单替代。这也意味着,即使企业已经采购H200用于AI模型训练,未来对于B30A这类推理专用计算卡仍然存在强烈需求,甚至其潜在市场空间有望超过H200。国内AI企业如深度求索(DeepSeek)已公开表示,其最新模型DeepSeek V4已针对Blackwell架构的FP4计算格式进行了专项优化,在原生平台运行时能够获得更优性能表现;与此同时,该公司也坦言当前整体算力资源依旧紧张。
然而,B30A的出口审批进程显然比H200更复杂,也更具不确定性。虽然该产品在去年8月就已基本准备就绪,但过去近一年时间仍未正式获得放行许可。业界普遍认为,这一审批过程背后涉及多方利益博弈。它不仅需要获得美方出口许可,还需要中方进口批准,同时也要综合评估国内AI芯片产业的发展节奏,尽量避免对处于成长阶段的国产算力与国产AI芯片生态带来过大冲击。
还有观点认为,美方可能希望在本土AI企业充分消化并享受Blackwell架构带来的技术领先优势之后,再考虑放宽定制版产品对华销售。按照当前预期,英伟达下一代Rubin架构产品预计要到2024年底至2025年才会进入大规模上市阶段,因此B30A获批的时间点短期内可能仍不会太快。未来中美双方仍存在数次高层会谈机会,相关议题的持续讨论,也将继续影响高端AI芯片出口、人工智能算力供应以及全球AI芯片贸易格局。
