硅基参考
首页
机器人产品
零配件
评测
论文
开源
数据集
实验室组织
专家人物
行业资讯
分享
具身智能论文库
Between MDPs and Semi-MDPs: A Framework for Temporal Abstraction in Reinforcement Learning
学术前沿
Between MDPs and Semi-MDPs: A Framework for Temporal Abstraction in Reinforcement Learning
Options框架,分层强化学习时间抽象奠基。
返回列表
论文
主体信息
Options框架,分层强化学习时间抽象奠基。