学术前沿

Between MDPs and Semi-MDPs: A Framework for Temporal Abstraction in Reinforcement Learning

Options框架,分层强化学习时间抽象奠基。

论文

主体信息

Options框架,分层强化学习时间抽象奠基。