MIRROR自蒸馏框架实现LLM个性化
热点事件持续更新
MIRROR自蒸馏框架实现LLM个性化
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
Huayi Lai等作者发布论文,提出个性化自蒸馏框架MIRROR,将大语言模型个性化从模仿参考文本转向偏好内化,用参考揭示的on-policy自蒸馏,在模型自身生成的轨迹上对齐next-token分布。该框架称通过元个性化将参考信息内化,而非直接模仿。
AI 根据报道生成 · 1 小时前更新
最新进展10月8日 12:00
MIRROR:让 LLM 个性化从模仿走向偏好内化报道时间线
沿着报道,了解事件的不同侧面。
10月8日
- arXiv:cs.CLMIRROR:让 LLM 个性化从模仿走向偏好内化
研究提出自蒸馏框架 MIRROR,将 LLM 个性化从模仿参考文本转向偏好内化,用参考揭示的 on-policy 自蒸馏对齐模型自身生成轨迹上的 next-token 分布。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。