返回
Disaggregated Design for GPU-Based Volumetric Data Structures
DOI:10.1007/978-3-031-99872-0_11.png)
摘要
En 中文
体数据结构通常优先考虑数据局部性,专注于高效的内存访问模式。这种单一关注可能忽视其他关键性能因素,如占用率、通信和核融合。我们引入了一种新颖的解耦设计,重新平衡了局部性与这些目标之间的权衡——减少分布式内存架构上的通信开销,缓解复杂边界条件下的寄存器压力,并实现核融合。我们对单节点多GPU格子玻尔兹曼方法(LBM)求解器进行了全面分析其优势。我们的评估涵盖了密集、块稀疏和多分辨率离散化,展示了我们设计的灵活性和效率。借助这种方法,我们在现有最佳解决方案上实现了高达3倍的加速。
Keyword:
Data layout
Parallel
Simulation
GPU
LBM
期刊
E
IF:
0
论文数:
21
被引数:
0

