跳到正文
arXiv cs.CL· Yue Wu, Qinghe Zhang, Yu Zhang, Jian Huang·· 4 小时前AI 评分31

CoDR:面向扩散语言模型的无训练置信度漂移重掩码方法

CoDR: Training-Free Confidence-Drift Remasking for Diffusion Language Models

AI 导读

针对掩码扩散语言模型(MDLM)已提交 token 不可逆、早期错误会传播的问题,研究者提出无训练、与采样器无关的细化方法 CoDR(Confidence Drift Remasking)。

来源:arXiv cs.CL · arxiv.org