arrow
返回

Reliability-based reinforcement learning driven maintenance policy optimization

delete2025-01-13
delete0
PRE
AI
M
Mehrab Tanhaeean
S
S.F. Ghaderi
M
Mohammad Sheikhalishahi *
M
Mohammad Khoobani
DOI:10.1080/15732479.2025.2451277delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
本研究提出了一种名为Q-learning算法的强化学习(RL)方法,用于确定设备的最佳维护策略。该方法涉及一个人工智能代理进行决策,以及一个代表设备的环境。代理创建维护策略并采取行动,而环境根据所选行动决定状态转移和奖励。维护策略的优化始于利用传感器数据预测设备可靠性。该预测方法结合了反向传播神经网络(BPNN)算法与拳击赛算法(BMA),这是一种进化元启发式算法。一种新颖的权重更新策略增强了人工神经网络在可靠性预测中的性能。该集成模型BMA-BPNN旨在提高预测可靠性的准确性。本研究通过预测设备可靠性来确定关键水平,并将成本和风险因素纳入决策过程,以优化维护策略。因此,Q-learning算法被用于根据设备可靠性识别最佳维护行动。实施一个考虑设备可靠性和成本的自动化维护系统,有助于减少因维护计划缺陷导致的事故。因此,本研究通过提供一种高效的设备维护方法,为该领域做出了贡献。
Keyword:
Boxing match algorithm
maintenance optimization
Markov decision process
metaheuristic algorithm
Q-learning algorithm
real time data
reinforcement learning

期刊

Structure and Infrastructure Engineering 封面图
Structure and Infrastructure Engineering
IF:
2.6
论文数:
469
被引数:
5.3K

机构

U
University of Tehran
学者数:
2.4W
论文数: 2.3W
被引数: 2.7W
T
Toronto Metropolitan University
学者数:
6.0K
论文数: 7.0K
被引数: 6.4K
引用论文

引用论文

Dynamic safety assessment of natural gas stations using Bayesian network基于贝叶斯网络的天然气站场动态安全评价
err2017-01-01
err205
errOAAI
errZarei, Esmaeil; Azadeh, Ali; Khakzad, Nima; Aliabadi, Mostafa Mirzaei; Mohammadfam, Iraj
err分享
err收藏
Estimating life cycle plant maintenance costs
err2000-06-01
err0
PREAI
errDavid J. Edwards; Gary D. Holt; Frank C. Harris
err分享
err收藏
Basic factors to forecast maintenance cost and failure processes for nuclear power plants
err2006-08-01
err0
PREAI
errElmira Popova; Wei Yu; Ernie Kee; Alice Sun; Drew Richards; Rick Grantom
err分享
err收藏
学者 查看更多内容