公司介绍
BAIR 是加州大学伯克利分校的 AI 研究联盟,涵盖 20 余位教职 PI 与上百名研究生,是强化学习、机器人学习与深度学习的核心学术力量之一。PI 包括 Pieter Abbeel、Sergey Levine、Stuart Russell、Ken Goldberg、Trevor Darrell、Jitendra Malik 等。
加州大学伯克利分校的 AI 研究联盟,覆盖强化学习、机器人、视觉与 NLP。
相关人物
相关论文
Deep Reinforcement Learning from Human Preferences
基于人类反馈的强化学习奠基论文,RLHF范式的起点。
Active Preference-Based Learning of Reward Functions主动询问人类偏好学习奖励函数,降低人机交互成本。
Model-Agnostic Meta-Learning for Fast Adaptation of Deep NetworksMAML元学习算法,少样本快速适应的奠基工作。
Trust Region Policy OptimizationTRPO策略优化算法,强化学习稳定性方向代表。
The Provably Beneficial AIRussell对有益AI的理论框架,价值对齐方向代表。
End-to-End Training of Deep Visuomotor Policies端到端深度视觉运动策略训练,深度RL机器人学习开山之作。
Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic ActorSAC最大熵off-policy强化学习算法,机器人学习事实标准。
Offline Reinforcement Learning: Tutorial, Review, and Outlook on Open Problems离线强化学习综述,Levine方向代表作。
Dex-Net 2.0: Deep Learning to Plan Robust Grasps with Synthetic Point Clouds and Analytic Grasp MetricsDex-Net抓取数据集与深度抓取规划。
Normalized Cuts and Image Segmentation归一化分割图像分割经典算法,视觉图论方法代表。
The Off-Switch Game可逆/关闭游戏,AI对齐中关于人类干预的形式化。
Rich Feature Hierarchies for Accurate Object Detection and Semantic SegmentationR-CNN区域卷积目标检测,深度学习视觉检测开山。
Learning Agile and Dynamic Motor Skills for Legged Robots腿式机器人敏捷运动强化学习,Nature子刊。
Shape Matching and Object Recognition Using Shape Contexts形状上下文,物体识别经典特征。