中文

R3-DLA(减少、重用、回收):一种更高效的去耦合前瞻架构方法

硬件体系结构 2018-12-14 v3 性能

摘要

现代社会对更强计算能力的需求贪得无厌。利用隐式并行性以提供自动性能提升仍是设计未来通用计算系统的核心目标。一种方法是使用独立的线程上下文执行连续前瞻,以改善主流水线的数据和指令供给。这种去耦合前瞻(DLA)架构能以相对直接的实现有效加速广泛应用。它还具有广泛的设计灵活性,因为前瞻代理无需关心正确性约束。在本文中,我们探索了若干优化,使前瞻代理更高效并从中提取更多效用。通过这些优化,DLA 架构在一组广泛的基准测试套件上相比最先进的微架构可实现平均 1.4 倍的加速,使其成为增强单线程性能的有力工具。

关键词

引用

@article{arxiv.1812.04514,
  title  = {R3-DLA (Reduce, Reuse, Recycle): A More Efficient Approach to Decoupled Look-Ahead Architectures},
  author = {Sushant Kondguli and Michael Huang},
  journal= {arXiv preprint arXiv:1812.04514},
  year   = {2018}
}

备注

16 pages, 16 Figures, Scheduled to appear in 25th IEEE International Symposium on High-Performance Computer Architecture 2019