游乐游手机版
首页/AI热点日报/热点详情

CXL技术三种模式、类型与应用详解

类型:热点整理2026-07-20
CXL,全称是Compute Express Link,这几年在数据中心和AI圈子里热度一直很高。它本质上是一种高速互联技术,目标很明确:在CPU、GPU、FPGA这类计算设备之间,以及它们与内存之间,搭起一条极速通道,实现更高吞吐量和更低延迟。 这项技术最早由英特尔、AMD等巨头联合推出,并很快得

CXL,全称是Compute Express Link,这几年在数据中心和AI圈子里热度一直很高。它本质上是一种高速互联技术,目标很明确:在CPU、GPU、FPGA这类计算设备之间,以及它们与内存之间,搭起一条极速通道,实现更高吞吐量和更低延迟。

这项技术最早由英特尔、AMD等巨头联合推出,并很快得到了谷歌、微软等云厂商的站台支持。

一、CXL介绍

CXL到底要解决什么问题?说白了,就是解决那个长期困扰业界的“内存鸿沟”。想象一下,一台服务器里,CPU有自己的内存池,旁边插着的各种翻跟斗(比如GPU、FPGA)也各自带着不小的显存或板载内存。这些内存资源被物理地分割开来,互不共享。结果就是:这边内存被闲置浪费,那边应用却因内存不够用而性能下降。这种割裂,不仅造成了巨大的资源浪费,还带来了系统设计的复杂性和延迟问题。

CXL诞生的背景,自然离不开PCIe。PCIe是计算机内部最通用的连接标准,设备通过它可以发起DMA(直接内存访问)来读写系统内存,只要告诉它目标物理地址就行。不过,在CXL正式登场之前,业内并不是没有其他尝试。比如IBM牵头搞的OpenCAPI,ARM阵营支持的CCIX,AMD等厂商力推的GenZ,以及Nvidia自家封闭的NVLink等等。这些协议各有千秋,但也带来了新的碎片化问题。

尽管PCIe一直在迭代提速,但它最初的设计架构,在面对处理器和翻跟斗之间那种低延迟、高带宽的紧密协同需求时,开始显得力不从心。于是,CXL应运而生,它目标明确,就是要补上PCIe在这一环的短板。

CXL技术的应用场景非常广泛。在数据中心里,它能把不同的计算和存储资源高效地互联起来,提升系统整体性能和资源利用率;在人工智能领域,它能让GPU、FPGA这些翻跟斗跟CPU更紧密地“并肩作战”,从而加快模型训练和推理的速度;在处理器互联方面,它甚至能把不同厂商的处理器整合到一起,提升系统的灵活性和整体计算能力。

二、CXL技术概览

2.1、什么是CXL技术?

CXL(Compute Express Link)本质上是一种高速串行协议,旨在让计算机系统内部的不同组件之间,实现快速且可靠的数据传输。它于2020年正式推出,由英特尔、戴尔和惠普等公司共同设计。它的核心目标,就是化解高性能计算面临的几大瓶颈:内存容量不足、内存带宽不够用、以及I/O延迟过高。

CXL不仅能实现内存扩展和内存共享,还能与GPU、FPGA这类翻跟斗进行高速通信,提供比传统方式更灵活、更高效的数据交换和处理能力。

除了高速传输,CXL的另一大亮点是支持内存共享和虚拟化。这个特性让不同设备之间的协作变得前所未有的紧密和高效。对于现代数据中心处理海量数据的诉求,以及AI、机器学习、区块链这类新兴应用的苛刻性能要求,CXL无疑提供了底层互联层面的关键支撑。

2.2、CXL技术的三种模式:CXL.io、CXL.cache和CXL.memory

CXL协议实际上包含了三个子协议,它们分工明确,共同构成了整个体系:

  • CXL.io: 这种模式主要用于将内存扩展到外部设备。它通过PCIe物理层连接CPU和外部设备,使得CPU能与外部设备共享内存,并直接访问外部设备的I/O资源,从而让数据传输速度更快。
  • CXL.cache: 这种模式通过把内存“缓存”到外部设备中来提升性能。具体来说,CPU可以在本地缓存中保留最常用的热数据,而将不常用的冷数据“寄存”在外部设备的内存中。这种方式能显著减少内存访问的延迟,提高系统整体性能。
  • CXL.memory: 这种模式最直接,就是把外部设备当作系统的主内存来使用。CPU会把外部设备的内存视为扩展内存空间,从而能存储更多的数据。好处是显而易见的:即使本地内存发生故障,CPU仍能通过外部设备上的内存继续运转,提升了系统的可靠性。

展开说,CXL.io是CXL规范中定义的物理层接口,它相比传统PCIe,能提供更低的延迟、更高的带宽和更好的可扩展性。它通过SerDes技术,在单个物理通道上同时传输多个不同的数据流——包括带宽密集型的数据流、低延迟的命令和控制信息,以及配置寄存器和状态信息。同时,它还支持热插拔和链路训练这些高级特性。

CXL.io的物理层规范对信号的电气特性、时序要求和连接器接口都做了精确定义,以确保高可靠性。信号速率上,它采用4x25Gbps或3x32Gbps,支持单向或双向通信。连接器方面,采用40个针脚的SMT连接器,其中27个针脚用于数据传输,其余的用于电源、地线和时钟信号。

根据应用场景,CXL设备通常被划分为三种类型:

  • Type 1: 通过PCIe插槽安装的加速卡或附加卡,主要用于网卡这类高速缓存设备。它们能与现有系统集成,并通过CXL接口与CPU直接通信,获得更快的数据传输速度。
  • Type 2: 在Type 1功能基础上,更侧重于高密度计算场景。典型代表就是GPU翻跟斗。这类设备不仅需要高性能计算,往往也带有大量内存,CXL能让CPU和GPU更高效地共享这些资源。
  • Type 3: 一种专用的存储设备,直接与主机处理器通信,主要用于内存缓冲器,目标是扩展内存带宽和容量。它通过CXL协议实现低延迟、高吞吐量的数据传输。

三、CXL技术的优势

CXL之所以能迅速获得行业认可,离不开以下几个核心优势:

  • 更快的数据传输速度: CXL技术最高可实现高达25GB/s的数据传输速度,比目前主流的PCIe 4.0还要快一大截。这意味着在大规模数据处理场景下,数据能够更快地被计算设备“喂饱”和处理。
  • 更低的延迟: 它直接将CPU、GPU、FPGA等计算设备与内存连接,绕开了传统的I/O总线,从而大幅降低了数据传输的时延,计算效率得到显著提升。
  • 更高的能效: 通过支持多台计算设备共享内存,有效减少了内存冗余。配合内存虚拟化技术,还能根据应用负载动态分配内存资源,进一步提升系统的能效比。
  • 更强的可扩展性: CXL支持内存热扩展,允许在不停机的情况下为系统添加更多内存容量。这让系统在面对未来高负载应用时,有了更灵活、更平滑的升级路径。
  • 更广泛的应用场景: 从传统的高性能计算、数据中心,到前沿的人工智能、区块链、物联网领域,CXL都找到了用武之地。

一句话总结:高带宽、低延迟、高灵活性、强可扩展性,并且能够支持不同类型硬件设备协同工作的混合使用场景。

四、CXL技术的应用

4.1、计算机系统中的应用

  • 高性能计算: 提供低延迟、高带宽的协议,用于连接CPU、GPU、FPGA等处理器,是高性能集群实现更快数据传输的关键一环。
  • 存储加速: 用于连接SSD和NVMe驱动器,提供更快的存储访问速度。与内存控制器集成后,能够为存储加速提供更大的带宽支持。
  • 人工智能: 连接专用AI芯片,提供更快的数据传输,从而显著提升AI工作负载的性能和训练效率。
  • 网络加速: 连接网络适配器,提供更快的网络传输速度,降低网络应用程序的处理延迟。

4.2、数据中心中的应用

  • 高性能计算: 相比传统PCIe,CXL能以更快的速度和更低的延迟支撑高性能计算任务,提高集群的计算效率和吞吐量。
  • 存储加速: 将存储翻跟斗直接与主机CPU连接,能实现更快的数据访问和更高的IOPS,是提升存储性能的有效途径。
  • AI加速: 将AI翻跟斗与CPU/GPU/FPGA等处理器直接连接,能显著加速模型训练和推理过程。
  • 大规模虚拟化: 将多个CPU和内存资源组合成一个大规模虚拟化集群,提高资源利用率和灵活性,同时降低管理的复杂性。

4.3、人工智能领域中的应用

  • 提高数据传输效率: 对于深度学习这类任务,大量数据需要在计算单元之间传输。传统PCIe互连的传输速度慢、往返延迟高,很容易成为瓶颈。CXL凭借低延迟、高速传输,能有效缓解这一问题,提升计算效率。
  • 加速模型训练: 深度学习模型越来越庞大,需要更多计算资源。CXL能让CPU、GPU和其他翻跟斗之间实现更紧密的协作,从而大幅提高模型训练的速度和效率。
  • 实现AI与物联网的集成: CXL技术可以让AI应用程序直接连接到物联网设备,实现更快速的数据处理和响应,这对需要实时决策的应用场景至关重要。
  • 降低能源消耗: CXL能够减少传输数据所需的功耗,并优化系统中的数据缓存策略,从而实现更高效的能源管理。

五、CXL技术与其他技术的对比

与PCIe、NVMe的比较:

  • 带宽: CXL的带宽远高于PCIe。例如,CXL 2.0标准最高可达32 GT/s,而PCIe 5.0的带宽仅为16 GT/s。NVMe是一种协议,其带宽取决于底层使用的互连技术。
  • 延迟: CXL和PCIe都具有低延迟特性,但CXL在延迟方面略胜一筹。NVMe协议在延迟方面表现也很出色。
  • 功能: CXL支持内存扩展、缓存一致性和设备直接内存访问等功能,这些是PCIe或NVMe不直接具备的。
  • 应用场景: PCIe主要用于连接GPU、网卡和存储设备等外设。NVMe专注于固态硬盘。CXL的适用范围更广,可用于连接处理器、存储设备、网络适配器等各种外围设备。
  • 兼容性: CXL相对较新,旧设备可能不支持。PCIe早已成为通用标准,兼容性最好。
  • 成本: 目前,CXL硬件和设备的成本相对较高,而PCIe则更加普及和经济实惠。

与CCIX的比较:

  • 性能: CXL提供更高的带宽和更低的延迟,在高性能计算、AI等场景更具优势。CCIX则更专注于低功耗和高可靠性,适用于物联网、移动设备等场景。
  • 兼容性: CXL基于PCIe协议,与现有PCIe接口兼容。而CCIX需要使用新的物理层和控制层,兼容性受限。
  • 应用场景: CXL适合需要高性能和强大内存扩展的场合,如大型服务器集群和超级计算机。CCIX则更适用于数据中心、物联网、移动设备等场景。
  • 支持的架构: CXL支持x86、Power和ARM等多种处理器架构。CCIX则主要专注于ARM和Power架构,对x86架构的支持有限。

六、实现CXL技术的挑战及解决方案

当然,一项新技术从实验室走向大规模部署,总会碰上几道槛。CXL目前面临的主要挑战包括:

  • 复杂性: 实现CXL需要高度复杂的系统设计和集成,这意味着要适配不同的硬件、软件和工具链。
  • 安全性: 由于CXL涉及到底层硬件操作和多个设备之间的数据共享,安全风险不容忽视,必须采取有效措施确保数据安全和隐私。
  • 性能: 要真正发挥CXL的高速传输和低延迟优势,需要高效的协议和深度优化的硬件与软件设计。
  • 兼容性: CXL需要与现有的接口和协议兼容,以支持旧设备和系统的平滑升级,这离不开合适的转换器和中间件。

针对这些挑战,行业正在从以下方向寻求突破:

  • 标准化: 制定统一的标准和规范,确保不同厂商的设备与系统之间能够高效互操作。
  • 优化设计: 通过优化硬件和软件设计来提升性能和安全性,比如增加硬件加速、内存缓存和错误纠正功能。
  • 管理数据共享: 采取访问控制、认证和加密等措施来管理设备间的数据共享。
  • 提供中间件: 开发转换器和中间件,帮助现有系统平滑过渡到CXL架构。

七、结论

回顾CXL技术的全貌,可以明确的一点是:它正在深刻改变&现代计算系统的互联格局。它带来了更广泛的应用场景——从超级计算机、AI翻跟斗到NVMe SSD,几乎覆盖了高性能计算的每一个角落。它提供了更高的带宽和更低的延迟,在处理大规模数据时展现出压倒性优势。它通过允许设备共享内存,极大地提升了内存的扩展性和灵活性,这在大型计算集群和超级计算机中前景广阔。同时,它基于PCIe协议,保证了良好的兼容性和可扩展性。最后,它支持x86、ARM、Power等多种处理器架构,为不同生态的系统提供了更灵活、更开放的选择。

来源:https://m.elecfans.com/article/2259004.html

相关热点

继续查看同栏目近期热点。

延伸阅读

补充最近整理过的热点入口。