跳到正文
arXiv cs.AI· Janis Zenkner, Tobias Sesterhenn, Tim Grams, Christian Bartelt·· 3 小时前AI 评分22

Solver-Aware Decomposition:让 PBE 分解器学会"如何征服"而非模仿标注

Solver-Aware Decompositions for Programming-by-Example: When Dividing Requires Knowing how to Conquer

AI 导读

针对基于分解的 Programming-by-Example(PBE),研究者提出 Solver-Aware Decomposition(SAD)训练框架:在保留 GT 子目标监督作为结构脚手架的同时,用策略梯度以冻结合成器的交叉熵损失为奖励在线优化分解器。

来源:arXiv cs.AI · arxiv.org