HuggingFace Daily Papers(社区热门论文)·· 3 小时前AI 评分33
掩码扩散语言模型的状态自适应:何时该切换去掩码策略?
Unmask the State: When Does State Adaptation Matter for Masked Diffusion Language Models
AI 导读
研究将掩码扩散语言模型(MDM)的推理拆为 score、cardinality、region、commitment、planning 五个维度,用"策略反转"衡量自适应机会,即最佳候选动作相对验证集选定固定动作的单步收益优势。
来源:HuggingFace Daily Papers(社区热门论文) · huggingface.co