arrow
返回

An Empirical Study of Test Code Summarization

delete2026-01-01
delete0
PRE
AI
Y
Yuanyuan Chen
X
Xiangping Chen
黄袁 封面图
黄袁 (Yuan Huang)
X
Xiaocong Zhou *
DOI:10.1007/978-981-95-3483-8_24delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
测试代码是软件测试实践中的具体表现形式,也是项目代码的重要组成部分。良好的摘要有助于程序员快速理解测试代码。然而,我们发现现有的代码摘要任务常常忽视测试代码,将其视为自动生成的代码并从数据集中移除。因此,现有摘要模型-数据集组合在测试代码摘要任务上的性能未知。为了获取其性能并找到最佳的模型-数据集组合,我们进行了一项实证研究。该研究基于5个基于深度学习的模型、3个数据集和4个指标。具体而言,3个数据集包括两个不包含测试代码的常用数据集以及我们收集的第一个JUnit测试代码摘要数据集JTS。JTS包含从GitHub上的9,211个Java开源项目中提取的94,270个JUnit测试代码-摘要对。由于现有的摘要模型已经相当稳健,而数据集几乎都不包含测试代码,我们在研究中修改了数据集。具体来说,除了探索现有模型-数据集组合在测试代码摘要任务上的性能外,我们还进一步研究了切换到重新引入测试代码的数据集和专门的测试代码摘要数据集对性能的影响。实验结果表明,现有的模型-数据集组合并不适合测试代码摘要任务。而对于此任务,优选的模型-数据集组合方案是。
Keyword:
Software Testing
Test Code Summarization
Empirical Study
Deep Learning
Code Summarization Datasets

期刊

B
BLOCKCHAIN AND TRUSTWORTHY SYSTEMS, BLOCKSYS 2025, PT II
IF:
0
论文数:
29
被引数:
0

机构

S
Sun Yat sen University
学者数:
7.7K
论文数: 2.0K
被引数: 1.8W
引用论文

引用论文

BLEU布卢
err2001-01-01
err0
errOAAI
errKishore Papineni; Salim Roukos; Todd Ward; Wei-Jing Zhu
err分享
err收藏
Measuring Program Comprehension: A Large-Scale Field Study with Professionals
err2018-10-01
err195
errOAAI
errXia, Xin; Bao, Lingfeng; Lo, David; Xing, Zhenchang; Hassan, Ahmed E.; Li, Shanping
err分享
err收藏
学者 查看更多内容