跳到正文
原文
HuggingFace Daily Papers(社区热门论文)·· 4 天前AI 评分33

掩码扩散语言模型的状态自适应:何时真正有效?

Unmask the State: When Does State Adaptation Matter for Masked Diffusion Language Models

AI 导读

研究将掩码扩散语言模型(MDM)的推理拆分为 score、cardinality、region、commitment、planning 五个维度,用"策略反转"衡量自适应机会,即最优候选动作相对验证集选定固定动作的单步收益优势。

来源:HuggingFace Daily Papers(社区热门论文) · arxiv.org