arrow
返回

Model-Aware Automatic Benchmark Generation with Self-Error Instructions for Data-Driven Models

delete2025-11-18
delete0
delete
OA
AI
K
Kirill Zakharov *
A
Alexander V. Boukhanovsky
DOI:10.3390/make7040148delete
delete原文链接
delete分享
delete收藏
查看原文
摘要

摘要

En 中文
领域特定的机器学习基准数量不断增加,推动了方法论上的进步,但实际部署需要不同的评估方法。为解决这一需求,提出了模型感知合成基准,旨在强调现有模型的失效模式。然而,评估已经表现良好的模型是一个重大挑战,因为模型出现错误的高质量数据点数量有限,难以获得统计上可靠的估计。为弥补这一差距,我们提出了一个两步基准构建过程:(i) 使用遗传算法扩充数据驱动模型预测质量较差的数据点;(ii) 使用生成模型近似这些点的分布。我们为这种基准构建建立了一般性表述,可适用于非经典机器学习模型。我们的实验研究表明,该方法能够实现对数据驱动模型在回归和分类问题上的准确评估。
AI总结

AI总结

对已上传原文的论文进行重点信息的提取,主要内容包括:简要概述、研究摘要、背景介绍、关键亮点、图文解析、展望与总结。

期刊

M
Machine Learning and Knowledge Extraction
IF:
6
论文数:
819
被引数:
1.8K

机构

I
ITMO University
学者数:
4.5K
论文数: 2.9K
被引数: 3.4K
引用论文

引用论文

Benchmarking machine learning methods for synthetic lethality prediction in cancer
err2024-10-20
err0
errOAAI
errFeng, Yimiao; Long, Yahui; Wang, He; Ouyang, Yang; Li, Quan; Wu, Min; Zheng, Jie
err分享
err收藏
TSGBench: Time Series Generation Benchmark
err2024-01-20
err0
PREAI
errYihao Ang; Qiang Huang; Yifan Bao; Anthony K. H. Tung; Zhiyong Huang
err分享
err收藏
err
IF0
err
err0
errOAAI
err
err分享
err收藏
Diversity creation methods: a survey and categorisation
err2005-03-01
err0
errOAAI
errGavin Brown; Jeremy Wyatt; Rachel Harris; Xin Yao
err分享
err收藏
学者 查看更多内容