arXiv cs.AI· Jordy Kieto·· 9 小时前AI 评分37
在梦境中学习、在现实中取胜:面向十英雄 MOBA 的连续 Dyna 循环
Learning in Dreams, Winning in Reality: A Continuous Dyna Loop for a Ten-Hero MOBA
AI 导读
研究者为完整十英雄 MOBA(206 个单位、每 tick 全英雄行动、单局最长 6,000 tick)学习结构化多智能体世界模型,仅用 1,400-tick 自由推演想象回合训练策略,再在真实对局中评测。
来源:arXiv cs.AI · arxiv.org