arrow
返回

Multi GPU Sparse Matrix by Sparse Matrix Multiplication

delete2025-11-30
delete0
delete
OA
AI
A
Artem Mavliutov *
G
Giovanni Isotton
C
Carlo Janna
A
Alessandro Celestini
M
Massimo Bernaschi
DOI:10.1002/cpe.70313delete
delete原文链接
delete分享
delete收藏
查看原文
摘要

摘要

En 中文
本文聚焦于改进现有的nsparse Nagasaka et al.算法,并将其扩展到多GPU设置,以应用于实际的工程问题。在本工作中,我们提出了一种针对SpGEMM的分布式多GPU框架,该框架专门为nsparse类算法设计。结果表明,nsparse算法实现了约2倍的性能提升,且多GPU扩展的扩展性与GPU数量接近理想状态。最后,我们在AMG设置中测试了所提出的算法,通过计算双SpGEMM乘积。
Keyword:
CUDA
GPUs
large matrices
MPI
AI总结

AI总结

对已上传原文的论文进行重点信息的提取,主要内容包括:简要概述、研究摘要、背景介绍、关键亮点、图文解析、展望与总结。

期刊

C
CONCURRENCY AND COMPUTATION-PRACTICE & EXPERIENCE
IF:
1.5
论文数:
473
被引数:
0

机构

U
University of Padua
学者数:
5.1W
论文数: 4.3W
被引数: 57
C
consiglio nazionale delle ricerche (cnr)
学者数:
6.2W
论文数: 5.7W
被引数: 48
引用论文

引用论文

PSM-nets: Compressing Neural Networks with Product of Sparse Matrices
err2021-07-18
err0
errOAAI
errLuc Giffon; Stephane Ayache; Hachem Kadri; Thierry Artieres; Ronan Sicre
err分享
err收藏
err
IF0
err
err0
PREAI
err
err分享
err收藏
A Systematic Survey of General Sparse Matrix-matrix Multiplication
err2023-03-02
err13
errOAAI
errGao, Jianhua; Ji, Weixing; Chang, Fangli; Han, Shiyu; Wei, Bingxin; Liu, Zeming; Wang, Yizhuo
err分享
err收藏
err分享
err收藏
Combinatorial BLAS 2.0: Scaling Combinatorial Algorithms on Distributed-Memory Systems
err2022-04-01
err19
errOAAI
errAzad, Ariful; Selvitopi, Oguz; Hussain, Md Taufique; Gilbert, John R.; Buluc, Aydin
err分享
err收藏
err分享
err收藏
学者 查看更多内容