arrow
返回

Improving Compiler Support for SIMD Offload Using Arm Streaming SVE

delete2026-01-01
delete0
PRE
AI
M
Mohamed Husain Noor Mohamed
A
Adarsh Patil *
L
Latchesar Ionkov
E
Eric Van Hensbergen
DOI:10.1007/978-3-032-07612-0_26delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
紧密耦合的核心邻近加速器(如Arm可扩展矩阵扩展SME)的广泛应用,取决于降低软件编程复杂度。本文聚焦于使C/C++编写的负载能够在流式可扩展向量扩展(SSVE)模式下使用SME架构。尽管当前编译器会针对所有类型的SIMD指令优化循环,但这些技术主要面向核心内的向量单元,在应用于解耦的核心邻近SIMD加速器时效果不佳。我们的目标是使编译器仅在有利可图时才自动为这类加速器生成代码。为此,我们通过两个编译器生态系统研究了实现高性能、精确且可重复计算卸载的路径。我们重新审视了LLVM编译器优化模块、MLIR转换及其相关的成本模型和启发式规则。我们希望这些见解能为编译器能力向下一代向量处理范式的自动代码生成演进提供方向。
Keyword:
Auto-vectorization
Arm SME
Arm Streaming SVE

期刊

H
HIGH PERFORMANCE COMPUTING WORKSHOPS, ISC HIGH PERFORMANCE 2025 INTERNATIONAL WORKSHOPS
IF:
0
论文数:
54
被引数:
0

机构

暂无机构信息
引用论文

引用论文

err分享
err收藏
An Evaluation of Vectorizing Compilers
err2011-10-01
err0
PREAI
errSaeed Maleki; Yaoqing Gao; María J. Garzarán; Tommy Wong; David A. Padua
err分享
err收藏
SPEC CPU2017
err2018-04-02
err0
PREAI
errJames Bucek; Klaus-Dieter Lange; Jóakim v. Kistowski
err分享
err收藏