跳到正文
原文
arXiv:cs.CL(计算语言学,全量分类)· Pranav Darshan, Pranav A, Sravan Karthick T, Minal Moharir, Ivan P. Yamshchikov·· 1 天前AI 评分37

语言模型幻觉检测中的可检测性差距:隐藏的异质性

The Detectability Gap: Hidden Heterogeneity in Hallucination Detection Across Language Models

AI 导读

研究在四个语言模型和三个事实问答数据集上发现,按答案一致性将幻觉分为高一致(Ghost)与低一致(Flickering)两类后,可检测性差距达 0.35 至 0.46 AUC。

来源:arXiv:cs.CL(计算语言学,全量分类) · arxiv.org