arrow
返回

CIMFlow: Modelling Dataflow in Cross-Layer Compute-in-Memory Deep Learning Accelerators

delete2025-09-01
delete0
delete
OA
AI
J
José Cubero-Cascante *
S
Schneider, Lucas Tonini Rosenberg
R
Rebecca Pelke
A
Arunkumar Vaidyanathan
R
Rainer Leupers
J
Jan Moritz Joseph
DOI:10.1145/3760780delete
delete原文链接
delete分享
delete收藏
查看原文
摘要

摘要

En 中文
传统深度学习加速器(DLAs)依赖片外存储器存储大型权重张量,导致高带宽需求和能耗。存内计算(CIM)加速器通过集成高密度非易失性存储器阵列缓解这一问题,实现完全权重驻留(FWS)数据流。多核CIM系统通过跨层推理进一步提升效率,其中中间张量保持在片上,核心以流水线方式运行。尽管存在多种架构提案,但现有工具无法建模多核CIM加速器的数据流、存储器访问模式及时序行为。我们提出CIMFlow,一种用于跨层CIM架构的建模框架。我们的灵活硬件架构模型包含CIM和数字核心,并利用缓冲存储惯用法实现分布式基于令牌的流控制。基于Array-OL的工作负载模型捕获卷积神经网络(CNN)的多维依赖关系,并应用硬件感知变换。这些模型被转换为带时序的循环静态数据流图进行仿真。CIMFlow提供延迟、能耗以及核心和缓冲器利用率跟踪。针对前沿CNN的案例研究表明,跨层推理可将延迟降低高达52倍。我们还发现,忽略存储器访问延迟会导致吞吐量高估高达308%。据我们所知,CIMFlow是首个聚焦FWS跨层执行且显式建模数据移动成本的CIM架构工具。它为下一代CIM加速器的设计空间探索提供了强大的成本模型。
Keyword:
Compute-in-memory
cross-layer
dataflow simulation
AI总结

AI总结

对已上传原文的论文进行重点信息的提取,主要内容包括:简要概述、研究摘要、背景介绍、关键亮点、图文解析、展望与总结。

期刊

ACM Transactions on Embedded Computing Systems 封面图
ACM Transactions on Embedded Computing Systems
IF:
2.6
论文数:
227
被引数:
2.3K

机构

R
RWTH Aachen University
学者数:
3.5W
论文数: 2.6W
被引数: 3.6W
引用论文

引用论文

err
IF0
err
err0
PREAI
err
err分享
err收藏
MTIA: First Generation Silicon Targeting Meta's Recommendation SystemsMTIA:第一代芯片,旨在支持Meta的推荐系统
err2023-06-17
err0
PREAI
errAmin Firoozshahian; Joel Coburn; Roman Levenstein; Rakesh Nattoji; Ashwin Kamath; Olivia Wu; Gurdeepak Grewal; Harish Aepala; Bhasker Jakka; Bob Dreyer; Adam Hutchin; Utku Diril; Krishnakumar Nair; Ehsan K. Aredestani; Martin Schatz; Yuchen Hao; Rakesh Komuravelli; Kunming Ho; Sameer Abu Asal; Joe Shajrawi; Kevin Quinn; Nagesh Sreedhara; Pankaj Kansal; Willie Wei; Dheepak Jayaraman; Linda Cheng; Pritam Chopda; Eric Wang; Ajay Bikumandla; Arun Karthik Sengottuvel; Krishna Thottempudi; Ashwin Narasimha; Brian Dodds; Cao Gao; Jiyuan Zhang; Mohammed Al-Sanabani; Ana Zehtabioskuie; Jordan Fix; Hangchen Yu; Richard Li; Kaustubh Gondkar; Jack Montgomery; Mike Tsai; Saritha Dwarakapuram; Sanjay Desai; Nili Avidan; Poorvaja Ramani; Karthik Narayanan; Ajit Mathews; Sethu Gopal; Maxim Naumov; Vijay Rao; Krishna Noru; Harikrishna Reddy; Prahlad Venkatapuram; Alexis Bjorlin
err分享
err收藏
err分享
err收藏
Buffets
err2019-04-04
err0
errOAAI
errMichael Pellauer; Yakun Sophia Shao; Jason Clemons; Neal Crago; Kartik Hegde; Rangharajan Venkatesan; Stephen W. Keckler; Christopher W. Fletcher; Joel Emer
err分享
err收藏
A Heterogeneous and Programmable Compute-In-Memory Accelerator Architecture for Analog-AI Using Dense 2-D Mesh使用密集二维网格的模拟AI的异构和可编程内存计算加速器架构
err2023-01-01
err0
PREAI
errShubham Jain; Hsinyu Tsai; Ching-Tzu Chen; Ramachandran Muralidhar; Irem Boybat; Martin M. Frank; Stanislaw Wozniak; Milos Stanisavljevic; Praneet Adusumilli; Pritish Narayanan; Kohji Hosokawa; Masatoshi Ishii; Arvind Kumar; Vijay Narayanan; Geoffrey W. Burr
err分享
err收藏
err分享
err收藏
学者 查看更多内容