arrow
返回

Neural network compression for reinforcement learning tasks

delete2025-03-21
delete0
delete
OA
AI
D
Dmitry Ivanov
D
Denis Larionov
O
Oleg V. Maslennikov *
V
Vladimir Voevodin
DOI:10.1038/s41598-025-93955-wdelete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
在实际强化学习(RL)应用中,如机器人技术等领域,低延迟、节能且高吞吐量的推理非常关键。利用稀疏性和剪枝来优化神经网络推理,特别是提高能效、延迟和吞吐量,是一种标准技术。在本工作中,我们系统性地研究了这些优化技术在主流RL算法(具体为深度Q网络和软演员评论家算法)以及不同RL环境(包括MuJoCo和Atari)中的应用,实现了神经网络规模最多减少400倍。本研究系统探讨了使用剪枝和量化优化RL任务中神经网络的适用性极限,并从硬件部署的角度出发,旨在降低功耗和延迟,同时提升吞吐量。
Keyword:
Pruning
Quantization
Reinforcement learning

期刊

Scientific Reports 封面图
Scientific Reports
IF:
3.9
论文数:
27.9W
被引数:
83.5W

机构

R
russian acad sci
学者数:
3.7K
论文数: 1.1K
被引数: 204
C
chuvash state univ
学者数:
6
论文数: 3
被引数: 0
引用论文

引用论文

MAERI
err2018-03-19
err0
PREAI
errHyoukjun Kwon; Ananda Samajdar; Tushar Krishna
err分享
err收藏
Is perception discrete or continuous?
err2003-05-01
err492
PREAI
errVanRullen, R; Koch, C
err分享
err收藏
Spike-driven multi-scale learning with hybrid mechanisms of spiking dendrites
err2023-07-01
err37
PREAI
errYang, Shuangming; Pang, Yanwei; Wang, Haowen; Lei, Tao; Pan, Jing; Wang, Jian; Jin, Yaochu
err分享
err收藏
Deep reinforcement learning with significant multiplications inference
err2023-11-27
err0
errOAAI
errIvanov, Dmitry A.; Larionov, Denis A.; Kiselev, Mikhail V.; Dylov, Dmitry V.
err分享
err收藏
Neuromorphic artificial intelligence systems神经形态人工智能系统
err2022-09-14
err42
errOAAI
errIvanov, Dmitry; Chezhegov, Aleksandr; Kiselev, Mikhail; Grunin, Andrey; Larionov, Denis
err分享
err收藏
Data scheduling and placement in deep learning accelerator
err2021-07-10
err5
PREAI
errMirmahaleh, Seyedeh Yasaman Hosseini; Reshadi, Midia; Bagherzadeh, Nader; Khademzadeh, Ahmad
err分享
err收藏
Human-level control through deep reinforcement learning通过深度强化学习实现人类层面的控制
err2015-02-25
err0
PREAI
errVolodymyr Mnih; Koray Kavukcuoglu; David Silver; Andrei A. Rusu; Joel Veness; Marc G. Bellemare; Alex Graves; Martin Riedmiller; Andreas K. Fidjeland; Georg Ostrovski; Stig Petersen; Charles Beattie; Amir Sadik; Ioannis Antonoglou; Helen King; Dharshan Kumaran; Daan Wierstra; Shane Legg; Demis Hassabis
err分享
err收藏
A Domain-Specific Supercomputer for Training Deep Neural Networks
err2020-06-18
err176
errOAAI
errJouppi, Norman P.; Yoon, Doe Hyun; Kurian, George; Li, Sheng; Patil, Nishant; Laudon, James; Young, Cliff; Patterson, David
err分享
err收藏
学者 查看更多内容