返回
Improving Compiler Support for SIMD Offload Using Arm Streaming SVE
DOI:10.1007/978-3-032-07612-0_26.png)
摘要
En 中文
紧密耦合的核心邻近加速器(如Arm可扩展矩阵扩展SME)的广泛应用,取决于降低软件编程复杂度。本文聚焦于使C/C++编写的负载能够在流式可扩展向量扩展(SSVE)模式下使用SME架构。尽管当前编译器会针对所有类型的SIMD指令优化循环,但这些技术主要面向核心内的向量单元,在应用于解耦的核心邻近SIMD加速器时效果不佳。我们的目标是使编译器仅在有利可图时才自动为这类加速器生成代码。为此,我们通过两个编译器生态系统研究了实现高性能、精确且可重复计算卸载的路径。我们重新审视了LLVM编译器优化模块、MLIR转换及其相关的成本模型和启发式规则。我们希望这些见解能为编译器能力向下一代向量处理范式的自动代码生成演进提供方向。
Keyword:
Auto-vectorization
Arm SME
Arm Streaming SVE
期刊
机构
暂无机构信息

