arXiv stat.ML· Yunxiao Zhao, Changxiao Cai·· 4 小时前AI 评分24
通过直接最小化期望解码轮数训练并行投机草稿模型
Training Parallel Speculative Draft Models by Directly Minimizing Expected Decoding Rounds
AI 导读
研究者提出 Expected Decoding Rounds(EDR)目标,将投机解码建模为马尔可夫奖励过程,用状态占用率加权局部拒绝成本,精确等于期望解码轮数且无需额外超参数。
来源:arXiv stat.ML · arxiv.org