arrow
返回

Deep Active Learning for Label-Efficient Refactoring Prediction

delete2026-04-27
delete0
delete
OA
AI
A
Abdulmajeed Alameer *
A
Amal Alazba
DOI:10.3390/info17050420delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
软件重构提高了代码的可维护性并减少了技术债务,但构建带标签的重构数据集是一个昂贵且劳动密集型的过程。为使重构预测在有限的标注预算下更具可部署性,本文介绍了一个深度主动学习(DAL)流水线,该流水线迭代训练一个基于软件度量表示的深度神经网络分类器,并选择性地查询最具信息量的未标注实体的标签。我们提出的方法在基于池的设置中对类级、方法级和变量级重构数据集(多种重构类型)进行了评估,采用一致的训练协议和广泛的查询策略。结果表明,DAL能够以显著更少的标签恢复接近全数据的有效性:平均而言,达到目标性能需要类级重构的11.4%、方法级重构的25.0%和变量级重构的20.0%的标注数据——对应约75-89%的标注节省,证明了重构预测的数据效率提升。此外,基于不确定性和dropout增强的策略在重构类型和标注预算方面是最一致有效的查询策略。
Keyword:
software refactoring
refactoring prediction
active learning
deep active learning
uncertainty sampling
MC-dropout
software metrics
machine learning for software engineering

期刊

I
Information
IF:
2.9
论文数:
861
被引数:
9.8K

机构

K
king saud university
学者数:
6.0K
论文数: 3.1K
被引数: 1
引用论文

引用论文

err
IF0
err
err0
PREAI
err
err分享
err收藏
err分享
err收藏
Towards just-in-time refactoring recommenders
err2018-05-28
err0
PREAI
errJevgenija Pantiuchina; Gabriele Bavota; Michele Tufano; Denys Poshyvanyk
err分享
err收藏
RefactorScore: Evaluating Refactor Prone Code
err2023-11-01
err1
PREAI
errJesse, Kevin; Kuhmuench, Christoph; Sawant, Anand
err分享
err收藏
Active Hidden Markov Models for Information Extraction
err2001-09-03
err0
PREAI
errTobias Scheffer; Christian Decomain; Stefan Wrobel
err分享
err收藏
学者 查看更多内容