arrow
返回

TWEEF: Trustworthiness Estimation and Enhancement Framework for Machine Learning Models

delete2026-01-21
delete0
PRE
AI
J
Jonathan Ugalde *
R
Rodrigo Salas *
R
Romina Torres
D
Daira Velandia
A
Aurelio F. Bariviera
P
P. A. Estévez
M
María Paz Godoy
DOI:10.3390/app16021077delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
机器学习(ML)在高影响力领域的快速应用,加剧了对超越传统性能指标的系统性工具的需求,以评估和提升预测模型的可靠性。本文提出TWEEF(可靠性评估与增强框架),一个模块化且可扩展的框架,通过性能、公平性和可解释性的联合评估来操作化可靠性。TWEEF整合直觉模糊逻辑和主观逻辑,将定量可靠性相关指标转化为语言评估,随后使用语言加权平均(LWA)、高斯加权聚合(GWA)和主观逻辑(SL)等算子进行聚合。该框架通过元估计器TrustworthyClassifier扩展scikit-learn生态系统,该估计器在一个统一的、与管道兼容的工作流程中协调指标计算、偏差缓解程序、代理模型生成和可靠性聚合。该框架通过在二元分类设置中对广泛使用的基准数据集(德国信用、COMPAS和成人)进行的四项实验进行经验评估。结果表明,TWEEF能够持续揭示仅依赖预测性能时可能隐藏的公平性和可解释性局限性,并且所得可靠性评分对不同指标配置和加权方案做出一致响应。这些发现表明,TWEEF为可靠性评估和增强提供了一种结构化机制,同时也为未来扩展到其他学习任务和评估维度提供了灵活的基础。
Keyword:
trustworthiness
fairness
interpretability
fuzzy logic
subjective logic

期刊

A
Applied Sciences-Basel
IF:
2.5
论文数:
7.6K
被引数:
4

机构

U
universidad de valparaiso
学者数:
2.6K
论文数: 2.2K
被引数: 4
U
Universitat Rovira i Virgili
学者数:
1.0W
论文数: 8.4K
被引数: 9.0K
引用论文

引用论文

Certifying and Removing Disparate Impact
err2015-08-10
err0
errOAAI
errMichael Feldman; Sorelle A. Friedler; John Moeller; Carlos Scheidegger; Suresh Venkatasubramanian
err分享
err收藏
Trustworthy AI
err2021-09-22
err80
errOAAI
errWing, Jeannette M.
err分享
err收藏
AI Fairness 360: An extensible toolkit for detecting and mitigating algorithmic bias
err2019-07-01
err0
PREAI
errR. K. E. Bellamy; K. Dey; M. Hind; S. C. Hoffman; S. Houde; K. Kannan; P. Lohia; J. Martino; S. Mehta; A. Mojsilovic; S. Nagar; K. Natesan Ramamurthy; J. Richards; D. Saha; P. Sattigeri; M. Singh; K. R. Varshney; Y. Zhang
err分享
err收藏
学者 查看更多内容