中文

PIM 还是 CXL-PIM?通过大规模基准测试理解架构权衡

新兴技术 2025-11-20 v2 性能

摘要

处理器内存储器 (PIM) 通过在存储器附近执行计算来减少数据传输,但我们对真实 PIM 硬件的大规模特征表明,端到端性能常常受制于主机与设备地址空间的分离,从而强制进行显式的 staging 传输。相比之下,CXL-PIM 提供统一的地址空间和缓存一致性访问,但代价是更高的访问延迟。这种相互冲突的接口模型在工作负载相关的权衡方面尚未被小规模研究所捕捉。本文 presents 对 PIM 与 CXL-PIM 的一次侧边对比、大规模比较,使用来自真实 PIM 硬件的测量数据和基于 trace 的 CXL 模型。我们识别了在统一地址访问足以弥和链路延迟的情形,以及在紧密耦合的 PIM 仍然更可取的情形。我们的结果揭示了在相位和数据集大小 regime 中,两种架构之间的相对排名会反转,从而为未来的近存储系统设计提供了实用性指导。

关键词

引用

@article{arxiv.2511.14400,
  title  = {PIM or CXL-PIM? Understanding Architectural Trade-offs Through Large-Scale Benchmarking},
  author = {I-Ting Lee and Bao-Kai Wang and Liang-Chi Chen and Wen Sheng Lim and Da-Wei Chang and Yu-Ming Chang and Chieng-Chung Ho},
  journal= {arXiv preprint arXiv:2511.14400},
  year   = {2025}
}