热点事件持续更新
Box² Bench 评测模型选择性依赖外部指导
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
2026年10月1日,HuggingFace Daily Papers 报道了一项关于语言模型能否选择性依赖外部指导的研究。研究提出 Box² Bench,在模型与任务固定的前提下,对比无工作流、有益工作流和误导性工作流三种条件,发现即使能力较强的模型仍易受不可靠外部指导拖累。团队仅用坏工作流训练两个开源权重模型:反事实监督微调显著提升其对误导性指导的鲁棒性,基于结果的强化学习则让其更善用有益工作流,且训练中从未见过好工作流。该能力还迁移到多智能体推理的同伴纠错与受损记忆场景。
AI 根据报道生成 · 2 小时前更新
最新进展10月1日 12:39
研究提出 Box² Bench,发现强模型仍易受误导性外部指导拖累。报道时间线
沿着报道,了解事件的不同侧面。
10月1日
- HuggingFace Daily Papers(社区热门论文)语言模型能否选择性依赖外部指导?Box² Bench 与选择性依赖训练研究
研究提出 Box² Bench,在模型与任务固定的前提下对比无工作流、有益工作流和误导性工作流,发现即使能力较强的模型仍易受不可靠外部指导拖累。团队仅用坏工作流训练两个开源权重模型,反事实监督微调显著提升其对误导性指导的鲁棒性,基于结果的强化学习则让其更善用有益工作流,且训练中从未见过好工作流。该能力还迁移到多智能体推理的同伴纠错与受损记忆场景。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。