模型
Gemini Robotics Google DeepMind 视觉-语言-动作机器人基础模型,基于 Gemini 2.0,支持灵巧操作与少样本适配。
- 模型类型
- foundation
- 发布日期
- 2025/3/25
硅基参考模型库记录 VLA、VLM、策略模型、扩散策略与控制模型的组织、模态、硬件支持与论文关系,便于按能力路线检索。
Google DeepMind 视觉-语言-动作机器人基础模型,基于 Gemini 2.0,支持灵巧操作与少样本适配。
Google DeepMind 视觉-语言-动作模型,将 VLM 与机器人控制统一为 token 预测。
Google Robotics Transformer,在 13 万真实轨迹 700+ 任务上实现机器人控制泛化。
DeepMind 围棋 AI,结合深度神经网络与蒙特卡洛树搜索,首次击败职业人类棋手。