硅基参考
首页
机器人产品
零配件
评测
论文
开源
数据集
实验室组织
专家人物
行业资讯
具身模型库
RT-2
模型
RT-2
Google DeepMind 视觉-语言-动作模型,将 VLM 与机器人控制统一为 token 预测。
返回列表
模型
主体信息
Google DeepMind 视觉-语言-动作模型,将 VLM 与机器人控制统一为 token 预测。
相关论文
RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control
RT-2 把视觉语言模型迁移到机器人控制,实现 VLA 统一架构。