公司库

伯克利人工智能研究

BAIR 是加州大学伯克利分校的 AI 研究联盟,涵盖 20 余位教职 PI 与上百名研究生,是强化学习、机器人学习与深度学习的核心学术力量之一。PI 包括 Pieter Abbeel、Sergey Levine、Stuart Russell、Ken Goldberg、Trevor Darrell、Jitendra Malik 等。

Berkeley 2014 年成立 研究机构 / 大学实验室 research

公司介绍

BAIR 是加州大学伯克利分校的 AI 研究联盟,涵盖 20 余位教职 PI 与上百名研究生,是强化学习、机器人学习与深度学习的核心学术力量之一。PI 包括 Pieter Abbeel、Sergey Levine、Stuart Russell、Ken Goldberg、Trevor Darrell、Jitendra Malik 等。

加州大学伯克利分校的 AI 研究联盟,覆盖强化学习、机器人、视觉与 NLP。

相关人物

相关论文

Deep Reinforcement Learning from Human Preferences

基于人类反馈的强化学习奠基论文,RLHF范式的起点。

Active Preference-Based Learning of Reward Functions

主动询问人类偏好学习奖励函数,降低人机交互成本。

Model-Agnostic Meta-Learning for Fast Adaptation of Deep Networks

MAML元学习算法,少样本快速适应的奠基工作。

Trust Region Policy Optimization

TRPO策略优化算法,强化学习稳定性方向代表。

The Provably Beneficial AI

Russell对有益AI的理论框架,价值对齐方向代表。

End-to-End Training of Deep Visuomotor Policies

端到端深度视觉运动策略训练,深度RL机器人学习开山之作。

Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor

SAC最大熵off-policy强化学习算法,机器人学习事实标准。

Offline Reinforcement Learning: Tutorial, Review, and Outlook on Open Problems

离线强化学习综述,Levine方向代表作。

Dex-Net 2.0: Deep Learning to Plan Robust Grasps with Synthetic Point Clouds and Analytic Grasp Metrics

Dex-Net抓取数据集与深度抓取规划。

Normalized Cuts and Image Segmentation

归一化分割图像分割经典算法,视觉图论方法代表。

The Off-Switch Game

可逆/关闭游戏,AI对齐中关于人类干预的形式化。

Rich Feature Hierarchies for Accurate Object Detection and Semantic Segmentation

R-CNN区域卷积目标检测,深度学习视觉检测开山。

Learning Agile and Dynamic Motor Skills for Legged Robots

腿式机器人敏捷运动强化学习,Nature子刊。

Shape Matching and Object Recognition Using Shape Contexts

形状上下文,物体识别经典特征。