arXiv:cs.AI(全量分类)· Zhaolong Su, Yujin Han, Feng Wang, Jameson Dong, Hins Hu, Difan Zou·· 1 天前AI 评分35
CoRe:协同演化奖励模型,缓解视频扩散模型中的潜在奖励攻击
CoRe: Co-Evolving Reward Models for Mitigating Latent Reward Hacking in Video Diffusion Models
AI 导读
针对固定潜在奖励模型优化会导致"潜在奖励攻击"、生成视频感知与运动质量下降的问题,研究者提出协同演化奖励框架 CoRe,持续用生成器当前样本重训奖励模型并锚定真实视频偏好,防止生成器通过偏离数据分布刷高奖励。在 Wan2.1-T2V-1.3B 上,CoRe 的生成质量优于预训练模型和既有对齐方法,且避免了固定奖励优化的质量崩溃。
来源:arXiv:cs.AI(全量分类) · arxiv.org