跳到正文
arXiv stat.ML· Yunxiao Zhao, Changxiao Cai·· 4 小时前AI 评分24

通过直接最小化期望解码轮数训练并行投机草稿模型

Training Parallel Speculative Draft Models by Directly Minimizing Expected Decoding Rounds

AI 导读

研究者提出 Expected Decoding Rounds(EDR)目标,将投机解码建模为马尔可夫奖励过程,用状态占用率加权局部拒绝成本,精确等于期望解码轮数且无需额外超参数。

来源:arXiv stat.ML · arxiv.org