HuggingFace Daily Papers(社区热门论文)·· 3 小时前AI 评分49
语言模型能否选择性依赖外部指导?Box² Bench 与选择性依赖训练研究
Thinking Outside the Box: Can Language Models Rely on External Guidance Selectively?
AI 导读
研究提出 Box² Bench,在模型与任务固定的前提下对比无工作流、有益工作流和误导性工作流,发现即使能力较强的模型仍易受不可靠外部指导拖累。团队仅用坏工作流训练两个开源权重模型,反事实监督微调显著提升其对误导性指导的鲁棒性,基于结果的强化学习则让其更善用有益工作流,且训练中从未见过好工作流。该能力还迁移到多智能体推理的同伴纠错与受损记忆场景。
来源:HuggingFace Daily Papers(社区热门论文) · huggingface.co