微软自研AI芯片的传闻终于不再是“狼来了”。在今年的Microsoft Ignite 2023大会上,这家软件巨头正式亮出了两款重磅硬件:面向数据中心的AI加速芯片Azure Maia 100,以及云端运算处理器Azure Cobalt 100。

先说说Azure Maia。这是一款专为AI工作负载设计的翻跟斗芯片,直接服务于OpenAI模型、ChatGPT、Bing、GitHub Copilot等业务。作为该系列的首款产品,Azure Maia 100采用5纳米制程生产,性能指标自然不低。而Azure Cobalt则是基于Arm架构的云端运算处理器,配备128个运算核心,相比前几代Azure Arm芯片,性能提升高达40%,主要支撑Microsoft Teams、Azure SQL这些核心服务。两款芯片都由台积电代工,微软已经在规划第二代产品了。
负责芯片开发的微软AHSI(Azure Hardware Systems and Infrastructure)副总裁Rani Borkar透露,微软已经在Bing和Office产品中测试新款AI芯片,OpenAI也拿GPT 3.5 Turbo做了测试。按计划,Azure Maia和Azure Cobalt将在明年初正式部署到微软数据中心,成为Azure云端运算服务的一部分。
Rani Borkar在接受外媒采访时说得挺直白:对微软这种体量的公司而言,优化和整合硬件的每个环节,既能提供最佳运算效能,又能规避供应链瓶颈。Azure Maia和Azure Cobalt给客户提供了新的基础设施选择。
自研芯片的好处不言而喻:在硬件性能和价格上握有主动权,同时避免过度依赖单一供应商。目前AI产业高度依赖NVIDIA GPU,这个问题尤其突出。亚马逊和Google早已布局——亚马逊2015年收购了以色列芯片创企Annapurna Labs,为客户提供云端和AI芯片服务;Google从2018年起就允许客户使用自研TPU。微软这次算是不甘落后,终于跟上了节奏。
当然,微软并没有完全押注自研。作为补充,微软也在拓展与芯片供应商的合作关系。官方消息显示,微软将在Azure中添加AMD MI300X加速虚拟机(ND MI300系列),采用AMD最新Instinct MI300X GPU,专门加速AI工作负载,支撑大范围AI模型训练和生成式推理。同时,基于英伟达H100 Tensor Core GPU的全新NC H100 v5虚拟机系列已开放预览,能提升大中型AI训练和生成式推理的性能、可靠性和效率。此外,微软还公布了ND H200 v5虚拟机系列计划,配备即将推出的英伟达H200 Tensor Core GPU。
回顾一下,微软过去有过定制芯片的经验,比如与AMD合作设计Xbox处理器,以及为HoloLens和Xbox Kinect运动控制器开发专用芯片。如今Azure Maia和Azure Cobalt正式登场,微软的自研芯片版图变得更为完整。
