返回
A Subdomain-Based GPU Parallel Scheme for Accelerating Perdynamics Modeling with Reduced Graphics Memory
DOI:10.32604/cmes.2026.075980.png)
摘要
En 中文
离散单元法(PD)在处理断裂问题中展现出独特优势,但其非局部性和无网格离散化导致高昂的计算与存储成本。此外,在工程应用中,传统GPU并行方案的运算规模常受限于GPU设备的有限显存。本研究开发了一种基于单元链接列表法的粒子信息管理策略,并在此基础上提出了基于子域的GPU并行方案,该方案在特定计算核心中表现出卓越的加速性能,同时显著降低显存使用。与经典并行方案相比,单元链接列表法促进了子域内粒子信息的有效管理,使所提并行方案通过优化子域大小和数量有效减少显存使用,并显著提升邻域搜索速度。PD算例表明,所提并行方案大幅提升了邻域搜索效率,相对于串行程序实现显著加速。例如,不计数据传输时间,该方案在一测试案例中实现高达1076.8倍的显著加速,归因于其在邻域搜索中的高效计算性能。此外,对于包含数千万粒子的2D和3D PD模型,显存使用量可分别降低至83.6%和85.9%。因此,该基于子域的GPU并行方案有效避免了显存不足问题,同时显著提升计算效率,为研究更复杂的大规模问题提供了新思路。
Keyword:
Peridynamics
GPU
CUDA
parallel computing
cell-linked list
期刊
C
IF:
2.5
论文数:
354
被引数:
0
机构
引用论文
暂无论文信息

