arXiv cs.AI· Amir Esterhuysen, Anders Jonsson·· 11 小时前AI 评分22
强化学习中的终端表示(Terminal Representation)
The Terminal Representation in Reinforcement Learning
AI 导读
研究提出终端表示(TR),一种结构上区别于后继表示(SR)和默认表示(DR)的新型强化学习表示方法。TR 与 DR 一样编码奖励加权轨迹,但可作为更低维对象学习,且无需特征分解即可直接用于选项发现、奖励塑形、迁移学习和探索等任务,同时绕开对称转移动态假设。
来源:arXiv cs.AI · arxiv.org