返回
SelfCheck-Eval: A multi-module framework for zero-resource hallucination detection in large language models
DOI:10.1016/j.patter.2026.101569.png)
摘要
En 中文
• SelfCheck-Eval无需访问大语言模型内部即可检测幻觉
• 引入AIME数学基准用于数学幻觉检测
• 所有现有方法均无法可靠地验证正确的数学推理
• 数学中的幻觉检测需要超越统计学习
Keyword:
hallucination detection
large language models
consistency and uncertainty quantification
context-based verification
AI总结
对已上传原文的论文进行重点信息的提取,主要内容包括:简要概述、研究摘要、背景介绍、关键亮点、图文解析、展望与总结。
期刊
IF:
7.4
论文数:
948
被引数:
3.6K
机构
引用论文
暂无论文信息

