公司介绍
BAIR 是加州大学伯克利分校的 AI 研究联盟,涵盖 20 余位教职 PI 与上百名研究生,是强化学习、机器人学习与深度学习的核心学术力量之一。PI 包括 Pieter Abbeel、Sergey Levine、Stuart Russell、Ken Goldberg、Trevor Darrell、Jitendra Malik 等。
加州大学伯克利分校的 AI 研究联盟,覆盖强化学习、机器人、视觉与 NLP。
资料概览
伯克利人工智能研究的公开企业档案显示:2014 年成立,主要公开地点为 United States · Berkeley,企业类型为 研究机构 / 大学实验室,公开阶段为 research。本页将企业信息与硅基参考收录的产品和技术资料交叉关联,便于继续核对。
当前资料库已关联2 位相关人物、14 篇论文。下方条目可用于继续查看具体产品、技术路线和公开资料,关联数量会随资料更新而变化。
公开资料中的行业标签包括reinforcement learning、robotics、computer vision、nlp、multimodal、ai safety。这些标签用于站内检索和实体关系导航,不构成投资建议或能力背书。
相关人物
相关论文
基于人类反馈的强化学习奠基论文,RLHF范式的起点。
Active Preference-Based Learning of Reward Functions主动询问人类偏好学习奖励函数,降低人机交互成本。
Model-Agnostic Meta-Learning for Fast Adaptation of Deep NetworksMAML元学习算法,少样本快速适应的奠基工作。
Trust Region Policy OptimizationTRPO策略优化算法,强化学习稳定性方向代表。
The Provably Beneficial AIRussell对有益AI的理论框架,价值对齐方向代表。
End-to-End Training of Deep Visuomotor Policies端到端深度视觉运动策略训练,深度RL机器人学习开山之作。
Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic ActorSAC最大熵off-policy强化学习算法,机器人学习事实标准。
Offline Reinforcement Learning: Tutorial, Review, and Outlook on Open Problems离线强化学习综述,Levine方向代表作。
Dex-Net 2.0: Deep Learning to Plan Robust Grasps with Synthetic Point Clouds and Analytic Grasp MetricsDex-Net抓取数据集与深度抓取规划。
Normalized Cuts and Image Segmentation归一化分割图像分割经典算法,视觉图论方法代表。
The Off-Switch Game可逆/关闭游戏,AI对齐中关于人类干预的形式化。
Rich Feature Hierarchies for Accurate Object Detection and Semantic SegmentationR-CNN区域卷积目标检测,深度学习视觉检测开山。
Learning Agile and Dynamic Motor Skills for Legged Robots腿式机器人敏捷运动强化学习,Nature子刊。
Shape Matching and Object Recognition Using Shape Contexts形状上下文,物体识别经典特征。