公司库

伯克利人工智能研究

BAIR 是加州大学伯克利分校的 AI 研究联盟,涵盖 20 余位教职 PI 与上百名研究生,是强化学习、机器人学习与深度学习的核心学术力量之一。PI 包括 Pieter Abbeel、Sergey Levine、Stuart Russell、Ken Goldberg、Trevor Darrell、Jitendra Malik 等。

Berkeley 2014 年成立 研究机构 / 大学实验室 research

公司介绍

BAIR 是加州大学伯克利分校的 AI 研究联盟,涵盖 20 余位教职 PI 与上百名研究生,是强化学习、机器人学习与深度学习的核心学术力量之一。PI 包括 Pieter Abbeel、Sergey Levine、Stuart Russell、Ken Goldberg、Trevor Darrell、Jitendra Malik 等。

加州大学伯克利分校的 AI 研究联盟,覆盖强化学习、机器人、视觉与 NLP。

资料概览

伯克利人工智能研究的公开企业档案显示:2014 年成立,主要公开地点为 United States · Berkeley,企业类型为 研究机构 / 大学实验室,公开阶段为 research。本页将企业信息与硅基参考收录的产品和技术资料交叉关联,便于继续核对。

当前资料库已关联2 位相关人物、14 篇论文。下方条目可用于继续查看具体产品、技术路线和公开资料,关联数量会随资料更新而变化。

公开资料中的行业标签包括reinforcement learning、robotics、computer vision、nlp、multimodal、ai safety。这些标签用于站内检索和实体关系导航,不构成投资建议或能力背书。

相关人物

相关论文

Deep Reinforcement Learning from Human Preferences

基于人类反馈的强化学习奠基论文,RLHF范式的起点。

Active Preference-Based Learning of Reward Functions

主动询问人类偏好学习奖励函数,降低人机交互成本。

Model-Agnostic Meta-Learning for Fast Adaptation of Deep Networks

MAML元学习算法,少样本快速适应的奠基工作。

Trust Region Policy Optimization

TRPO策略优化算法,强化学习稳定性方向代表。

The Provably Beneficial AI

Russell对有益AI的理论框架,价值对齐方向代表。

End-to-End Training of Deep Visuomotor Policies

端到端深度视觉运动策略训练,深度RL机器人学习开山之作。

Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor

SAC最大熵off-policy强化学习算法,机器人学习事实标准。

Offline Reinforcement Learning: Tutorial, Review, and Outlook on Open Problems

离线强化学习综述,Levine方向代表作。

Dex-Net 2.0: Deep Learning to Plan Robust Grasps with Synthetic Point Clouds and Analytic Grasp Metrics

Dex-Net抓取数据集与深度抓取规划。

Normalized Cuts and Image Segmentation

归一化分割图像分割经典算法,视觉图论方法代表。

The Off-Switch Game

可逆/关闭游戏,AI对齐中关于人类干预的形式化。

Rich Feature Hierarchies for Accurate Object Detection and Semantic Segmentation

R-CNN区域卷积目标检测,深度学习视觉检测开山。

Learning Agile and Dynamic Motor Skills for Legged Robots

腿式机器人敏捷运动强化学习,Nature子刊。

Shape Matching and Object Recognition Using Shape Contexts

形状上下文,物体识别经典特征。