跳到正文
原文
HuggingFace Daily Papers(社区热门论文)·· 3 小时前AI 评分33

掩码扩散语言模型的状态自适应:何时该切换去掩码策略?

Unmask the State: When Does State Adaptation Matter for Masked Diffusion Language Models

AI 导读

研究将掩码扩散语言模型(MDM)的推理拆为 score、cardinality、region、commitment、planning 五个维度,用"策略反转"衡量自适应机会,即最佳候选动作相对验证集选定固定动作的单步收益优势。

来源:HuggingFace Daily Papers(社区热门论文) · huggingface.co