跳到正文
原文
arXiv:cs.CL(计算语言学,全量分类)· Tianzhu Zhang·· 1 天前AI 评分46

LLM 何时该信任自己的修订?内在自纠正的风险感知研究

When Should LLMs Trust Their Own Revisions? A Risk-Aware Study of Intrinsic Self-Correction

AI 导读

一项研究在 BoolQ、GSM8K 和 Corr2Cause 上追踪 29 个开源权重 LLM 初始答案与修订答案的正确性转移,发现聚合准确率会掩盖截然不同的修订行为:Llama-3.1-8B 在 GSM8K 上提升 25.5 个百分点,同时有 19.1% 原本正确的答案被改错。

来源:arXiv:cs.CL(计算语言学,全量分类) · arxiv.org