arrow
返回

Optimizing Markov decision process state design for deep reinforcement learning manufacturing scheduling using Bayesian optimization

delete2025-10-01
delete0
delete
OA
AI
W
Woo‐Sik Yoo
J
J.-G. Kim
D
David Molina Concha
C
Chi-Guhn Lee *
DOI:10.1093/jcde/qwaf100delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
本研究探讨了贝叶斯优化在马尔可夫决策过程应用于生产调度问题时的特征选择应用。由于缺乏显式目标值和调度环境的动态特性,传统的监督学习特征选择方法不适用。为解决此问题,提出了一种双层优化框架,其中贝叶斯优化在顶层进行特征选择,强化学习在底层进行评估。在动态柔性作业车间和薄膜晶体管液晶显示器生产调度环境中进行的实验结果表明,该框架通过聚焦于重要特征,降低了计算复杂度,并提升了决策效果。研究发现强调了将状态表示与调度动态对齐的重要性,并为复杂环境下系统性特征选择的研究奠定了基础。
Keyword:
Bayesian optimization
deep reinforcement learning
production scheduling
Markov decision process
feature selection
manufacturing optimization

期刊

Journal of Computational Design and Engineering 封面图
Journal of Computational Design and Engineering
IF:
6.1
论文数:
401
被引数:
3.2K

机构

I
incheon national university
学者数:
4.0K
论文数: 4.3K
被引数: 4
U
university of toronto
学者数:
14.8W
论文数: 12.0W
被引数: 165
引用论文

引用论文

Deep Reinforcement Learning: A Brief Survey深度强化学习: 简要综述
err2017-11-01
err0
errOAAI
errKai Arulkumaran; Marc Peter Deisenroth; Miles Brundage; Anil Anthony Bharath
err分享
err收藏
err1998-01-01
err0
PREAI
errDonald R. Jones; Matthias Schonlau; William J. Welch
err分享
err收藏
Taking the Human Out of the Loop: A Review of Bayesian Optimization将人类带出循环: 贝叶斯优化的回顾
err2016-01-01
err3.5K
PREAI
errShahriari, Bobak; Swersky, Kevin; Wang, Ziyu; Adams, Ryan P.; de Freitas, Nando
err分享
err收藏
学者 查看更多内容