arrow
返回

SelfCheck-Eval: A multi-module framework for zero-resource hallucination detection in large language models

delete2026-06-05
delete0
delete
OA
AI
D
Diyana Muhammed
G
Giusy Giulia Tuccari
G
Gollam Rabby *
S
Sören Auer
S
Sahar Vahdati
DOI:10.1016/j.patter.2026.101569delete
delete原文链接
delete分享
delete收藏
查看原文
摘要

摘要

En 中文
• SelfCheck-Eval无需访问大语言模型内部即可检测幻觉 • 引入AIME数学基准用于数学幻觉检测 • 所有现有方法均无法可靠地验证正确的数学推理 • 数学中的幻觉检测需要超越统计学习
Keyword:
hallucination detection
large language models
consistency and uncertainty quantification
context-based verification
AI总结

AI总结

对已上传原文的论文进行重点信息的提取,主要内容包括:简要概述、研究摘要、背景介绍、关键亮点、图文解析、展望与总结。

期刊

Patterns 封面图
Patterns
IF:
7.4
论文数:
948
被引数:
3.6K

机构

L
Leibniz University Hannover
学者数:
1.1W
论文数: 8.5K
被引数: 1.1W
L
Leibniz Information Centre for Science and Technology
学者数:
9
论文数: 3
被引数: 0
U
university of catania
学者数:
3.1K
论文数: 1.1K
被引数: 0
学者 查看更多机构
引用论文

引用论文

暂无论文信息