FineART:细粒度标注双臂操作轨迹数据集与视觉语言动作模型
基于论文摘要,作者提出 FineART 双臂操作数据集与 FineART-VLA 视觉语言动作模型,用于长时程、多步骤操作任务。FineART 包含 40,543 个 episode、1,718 小时记录和 533,913 个子任务,覆盖 151 项任务;使用子任务标注进行中途训练后,模型遵循空间指令的成功率由 32.0% 提升至 100.0%。
本站判断:细粒度双臂轨迹标注与自预测子任务策略,为长时程操作的数据构建和模型评估提供具体基线。