跳到正文
arXiv cs.AI· Ankur Samanta, Yonathan Efroni, Paul Sajda, Kaveh Hassani, Anirudh Goyal·· 1 天前AI 评分27

MIRA:面向长时程研究智能体的元推理架构

Learning What to Investigate Next: Meta-Reasoning for Long-Horizon Research Agents

AI 导读

研究者提出 MIRA,一种将研究分配与执行分离的分层架构:外层元推理器从持久研究记录中整理上下文并生成下一步调查的工作指令,内层执行器逐条执行。无需策略训练,MIRA 在定理证明和开放式神经网络架构研究中提升了长时程推理并更有效分配额外算力。基于该先验初始化的生成式 actor-critic MIRA-AC 在四个 autoresearch 环境中提升了 gold 表现。

来源:arXiv cs.AI · arxiv.org