arXiv:cs.CL(计算语言学,全量分类)· Timo Pierre Schrader, Annemarie Friedrich, Simon Razniewski, Lukas Lange·· 1 天前AI 评分37
LLM 作为多值关系知识库的规范顺序问题:大语言模型为何不可靠
The Canonical Order Problem: When Large Language Models Are Unreliable Knowledge Bases for Multi-Valued Relations
AI 导读
研究发现 LLM 内部对多值关系按规范顺序(如字母序或时间序)组织概率分布,存在"规范顺序问题"。机制分析显示 LLM 的集合生成分为候选实体检索、内部排序、下一元素选择三个阶段,当提示词要求偏离这一内部顺序时,模型生成完整实体集合的可靠性显著下降。该成果已被 AKBC@EMNLP2026 接收。
来源:arXiv:cs.CL(计算语言学,全量分类) · arxiv.org