硅基参考
首页
机器人产品
零配件
评测
论文
开源
数据集
实验室组织
专家人物
行业资讯
具身智能论文库
Active Preference-Based Learning of Reward Functions
学术前沿
Active Preference-Based Learning of Reward Functions
主动询问人类偏好学习奖励函数,降低人机交互成本。
返回列表
新窗口打开 PDF
arXiv 摘要页
论文
主体信息
主动询问人类偏好学习奖励函数,降低人机交互成本。