CXL (Compute Express Link)
運算快取互連
CXL 是什麼?
CXL(Compute Express Link)是一種新一代高速互連技術,專為 AI 資料中心與高效能運算中的異質運算架構設計。它基於 PCIe 的實體層擴展,讓不同類型的運算單元(CPU、GPU、加速器等)能以低延遲、高效率共享記憶體資源,進而實現記憶體池化(Memory Pooling)與動態資源分配,為未來的運算彈性奠定基礎。
CXL 的核心規範由三個協定組成,可獨立運作或組合應用,以因應不同場景需求:
.CXL.io:功能與 PCIe 協定類似,負責資料傳輸與裝置管理,並提供更低延遲的 I/O 操作。
.CXL.cache:允許周邊設備直接快取並存取主機 CPU 的記憶體,同時確保資料一致性。
.CXL.memory:使主機 CPU 以快取一致性的方式存取設備端記憶體。
延伸閱讀: 打造 AI 工廠的記憶體革命 ─ CXL 記憶體池的崛起
CXL 的核心規範由三個協定組成,可獨立運作或組合應用,以因應不同場景需求:
.CXL.io:功能與 PCIe 協定類似,負責資料傳輸與裝置管理,並提供更低延遲的 I/O 操作。
.CXL.cache:允許周邊設備直接快取並存取主機 CPU 的記憶體,同時確保資料一致性。
.CXL.memory:使主機 CPU 以快取一致性的方式存取設備端記憶體。
延伸閱讀: 打造 AI 工廠的記憶體革命 ─ CXL 記憶體池的崛起
為什麼需要 CXL?
隨著生成式 AI 需求急速增長,系統效能的瓶頸已從運算能力轉向資料傳輸效率,即便 CPU 的性能不斷提升,卻受制於記憶體通道頻寬的限制,導致硬體無法充分發揮潛力,遇上了所謂的「記憶體牆」。
這種限制在傳統伺服器中普遍存在,不僅降低運算效率,也造成記憶體超額配置與資源浪費。透過 CXL 協定,CPU 能將不同來源的記憶體視為單一邏輯空間進行管理與存取,突破傳統插槽的容量限制,這樣的模組化設計,系統升級與維護更為便捷,也能為 AI 資料中心建立記憶體共享架構,實現低延遲、高吞吐量的動態資源調度,因應多變且高強度的資料密集型工作負載。
這種限制在傳統伺服器中普遍存在,不僅降低運算效率,也造成記憶體超額配置與資源浪費。透過 CXL 協定,CPU 能將不同來源的記憶體視為單一邏輯空間進行管理與存取,突破傳統插槽的容量限制,這樣的模組化設計,系統升級與維護更為便捷,也能為 AI 資料中心建立記憶體共享架構,實現低延遲、高吞吐量的動態資源調度,因應多變且高強度的資料密集型工作負載。