arXiv:cs.CL(计算语言学,全量分类)· Pranav Darshan, Pranav A, Sravan Karthick T, Minal Moharir, Ivan P. Yamshchikov·· 1 天前AI 评分37
语言模型幻觉检测中的可检测性差距:隐藏的异质性
The Detectability Gap: Hidden Heterogeneity in Hallucination Detection Across Language Models
AI 导读
研究在四个语言模型和三个事实问答数据集上发现,按答案一致性将幻觉分为高一致(Ghost)与低一致(Flickering)两类后,可检测性差距达 0.35 至 0.46 AUC。
来源:arXiv:cs.CL(计算语言学,全量分类) · arxiv.org