数据

Room-Across-Room (RxR)

RxR 含约 12.6 万条多语言视觉语言导航指令,覆盖英语、印地语、泰卢固语三种语言,并记录标注者描述时的视觉注意轨迹,是 VLN 领域规模最大、标注最细的多语言基准。

数据集

主体信息

RxR 含约 12.6 万条多语言视觉语言导航指令,覆盖英语、印地语、泰卢固语三种语言,并记录标注者描述时的视觉注意轨迹,是 VLN 领域规模最大、标注最细的多语言基准。

数据规模:具体轨迹数未公开,以官方公开口径为准。

任务类型:视觉语言导航、多语言指令跟随。数据模态:自然语言指令(英/印地/泰卢固语)、导航轨迹、同步眼动式指针标注。

采集 / 适用机器人平台:仿真移动机器人。

下载资源:GitHub 仓库(https://github.com/google-research-datasets/RxR)。

资源

下载与入口