开发者生态

OpenVLA

OpenVLA 由斯坦福、UC Berkeley 与 TRI 等团队开源,旨在提供可微调、可部署的通用机器人操作基座模型,降低 VLA 研究门槛。

开源项目

项目说明

OpenVLA 是开源的视觉-语言-动作模型,将视觉与语言指令映射为机器人动作序列。

项目提供预训练权重、微调脚本与推理示例,可直接在真实机械臂或仿真中部署。

选型标签

能力与适用场景

任务域

vlamanipulationimitation

框架 / 工具链

PyTorchHugging Face Transformers

主题标签

vlarobot-manipulationvision-language