跳到正文
arXiv cs.AI· Egor Pakhomov, Erik Nijkamp·· 5 小时前AI 评分24

智能体的历史行为能预测上下文压缩何时有害吗?TRACE 配对重放语料上的有限效应

Does an Agent's History Tell You When Compaction Will Hurt? A Modest, Bounded Effect on the TRACE Paired-Replay Corpus

AI 导读

研究基于 TRACE 公开语料库的 590 个 AppWorld 压缩边界,检验智能体近期行为能否预测上下文压缩带来的损害。结果显示边界前历史对压缩后损害的预测能力很弱,最佳扩展协议触发器在留出集上 AUROC 仅 0.66,而同一边界复现为 0.72;最佳冻结可解释触发器避开 21% 有害边界,同时保留 84% 的压缩机会。

来源:arXiv cs.AI · arxiv.org