Return
Explorative Policy Optimization for industrial-scale operation of complex process control systems
DOI:10.1016/j.jprocont.2025.103471.png)
Abstract
En 中文
• Dynamic exploration in state–action space for adapting to unmodeled dynamics. • Exploration network guides agent to underexplored actions, improving control. • EPO outperforms PPO and SAC in industrial process control under uncertain conditions. • Tuned TD index in GAE balances exploration and exploitation for stable gains. • Tested in penicillin production, EPO improved efficiency, stability, and yield.
Journal
IF:
3.9
Papers:
3.4K
Citations:
7.3K
Organization
No organization information available

