主体信息
Pieter Abbeel 是加州大学伯克利分校教授,BAIR 核心 PI。斯坦福博士(Andrew Ng 指导),研究方向覆盖机器人学习、强化学习与模仿学习,提出 Apprentice Learning、TRPO 等工作。联合创立 Covariant、Robotic Viewpoints,OpenAI 早期顾问。
伯克利教授,机器人强化学习方向代表,Covariant、Robotic Viewpoints 创始人。
相关论文
Model-Agnostic Meta-Learning for Fast Adaptation of Deep Networks
MAML元学习算法,少样本快速适应的奠基工作。
Trust Region Policy OptimizationTRPO策略优化算法,强化学习稳定性方向代表。
Apprenticeship Learning via Inverse Reinforcement Learning通过逆向强化学习从专家演示学习,Abbeel奠基工作。
End-to-End Training of Deep Visuomotor Policies端到端深度视觉运动策略训练,深度RL机器人学习开山之作。