arrow
返回

EMERALD-O: efficient multi-agent reinforcement learning framework for optimised deep learning hyperparameter tuning and selection

delete2025-09-08
delete0
PRE
AI
A
Akhila VH *
A
Anu Mary Chacko
P
Ponnurangam Kumaraguru
DOI:10.1007/s10489-025-06878-4delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
传统超参数调优方法,如贝叶斯优化和网格搜索,在复杂深度学习架构上往往证明计算成本高且效率低下。本文介绍了基于多智能体强化学习(MARL)的框架EMERALD-O,用于优化深度学习网络。该MARL方法利用两个专用智能体,Agent1专注于数据增强,Agent 2负责管理学习率和优化器选择。智能体在一个模拟模型训练动态的环境中进行操作,并使用验证准确率作为奖励信号。通过ε-贪心探索和经验回放机制提升智能体性能。EMERALD-O在改进分类准确率和训练效率方面表现优异,达到88.59%。该框架展现出对多样化数据集特征的适应性,凸显了可扩展性和鲁棒性。该框架在为图像分类问题构建的不同模型(基于Efficientnet、VGG16和VGG19)上进行了验证。结果表明强化学习在微调复杂神经网络架构方面的潜力,并表明MARL可作为提升深度学习模型性能的有力工具。EMERALD-O通过推动深度神经网络优化的前沿,证明强化学习能够从根本上改变模型调优方法。该框架为自动化超参数优化建立了新范式,并为分析深度学习模型在不同超参数配置下的行为提供了系统性视角。通过量化模型对参数变化的响应,该方法能够深入洞察架构特征和性能动态,促进对深度学习系统的理论理解与实践优化。
Keyword:
Multi-agent reinforcement learning
Hyperparameter optimization
Deep neural networks
Automated machine learning
Image classification
Experience replay

期刊

Applied Intelligence 封面图
Applied Intelligence
IF:
3.5
论文数:
7.6K
被引数:
1.7W

机构

I
International Institute of Information Technology
学者数:
57
论文数: 49
被引数: 212
N
National Institute of Technology
学者数:
1.7K
论文数: 832
被引数: 2.1K
引用论文

引用论文

Faster AutoAugment: Learning Augmentation Strategies Using Backpropagation
err2020-11-20
err0
errOAAI
errRyuichiro Hataya; Jan Zdenek; Kazuki Yoshizoe; Hideki Nakayama
err分享
err收藏
A systematic review of hyperparameter optimization techniques in Convolutional Neural Networks卷积神经网络中超参数优化技术的系统综述
err2024-06-01
err0
errOAAI
errMohaimenul Azam Khan Raiaan; Sadman Sakib; Nur Mohammad Fahad; Abdullah Al Mamun; Md. Anisur Rahman; Swakkhar Shatabda; Md. Saddam Hossain Mukta
err分享
err收藏
A review of research on reinforcement learning algorithms for multi-agents面向多智能体的强化学习算法研究综述
err2024-09-01
err12
PREAI
errHu, Kai; Li, Mingyang; Song, Zhiqiang; Xu, Keer; Xia, Qingfeng; Sun, Ning; Zhou, Peng; Xia, Min
err分享
err收藏
AutoAugment: Learning Augmentation Strategies From Data
err2019-06-01
err0
PREAI
errEkin D. Cubuk; Barret Zoph; Dandelion Mane; Vijay Vasudevan; Quoc V. Le
err分享
err收藏
Exploration in Deep Reinforcement Learning: From Single-Agent to Multiagent Domain
err2024-07-01
err41
errOAAI
errHao, Jianye; Yang, Tianpei; Tang, Hongyao; Bai, Chenjia; Liu, Jinyi; Meng, Zhaopeng; Liu, Peng; Wang, Zhen
err分享
err收藏
Evolving deep neural networks
err2024-01-01
err0
errOAAI
errRisto Miikkulainen; Jason Liang; Elliot Meyerson; Aditya Rawal; Dan Fink; Olivier Francon; Bala Raju; Hormoz Shahrzad; Arshak Navruzyan; Nigel Duffy; Babak Hodjat
err分享
err收藏
学者 查看更多内容