跳到正文
原文
arXiv:cs.CL(计算语言学,全量分类)· Mamehgol Yousefi, Ahmad Shahi, Mos Sharifi, Alvaro Romera, Simon Hoermann, Tham Piumsomboon·· 1 天前AI 评分33

提示词扰动如何影响大语言模型的偏见与幻觉:一项评估研究

Evaluating the Effects of Prompt Perturbation on Bias and Hallucination in Large Language Models

AI 导读

一项评估研究发现,对决策任务中的原始提问做扰动变体后,部分大语言模型的偏见与幻觉反而得到缓解,这与以往研究结论相反。在多数数据集任务上 Claude 3 表现更有效,GPT3.5 则表现参差,部分场景相当、部分明显落后。该研究发表于 ICONIP 2024,强调部署 LLM 决策助手需严格测试验证。

来源:arXiv:cs.CL(计算语言学,全量分类) · arxiv.org