HuggingFace Daily Papers(社区热门论文)·· 56 分钟前AI 评分41
UniEvo-VL:面向多模态模型自我改进的在线自蒸馏训练方案
UniEvo-VL: An On-policy Self-Distillation Training Recipe for Multimodal Model Self-improvement
AI 导读
UniEvo-VL 提出一种让多模态模型自我进化的在线自蒸馏训练方案,由同一模型分别以学生和教师身份、在不同上下文下充当师生,无需依赖独立的大型教师模型。基于开源 Qwen-image-2512,其 GenEval 分数从 0.747 提升至 0.808,GenEval2 Soft-TIFA 从 32.97 提升至 35.53。
来源:HuggingFace Daily Papers(社区热门论文) · huggingface.co