跳到正文
热点事件观察中

VIA以视觉界面零样本控制机器人

1 篇报道1 个报道来源1 天前更新

先了解这件事

AI 综述

Hengyuan Hu等提出VIA框架,让现成智能体通过可交互的视觉工作空间直接控制机器人,无需针对机器人训练或新增动作原语。基于论文摘要,VIA在仿真中完成了多类桌面操作,并在真实商用移动操作机器人上完成导航与操作任务,两种设置均为零样本。 智能体可用鼠标式工具探测像素,并向虚拟末端执行器设置目标位姿;论文还报告其性能随底层基础模型能力增强而提升,但摘要未给出具体任务规模、成功率或对比基线。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月8日
  1. arXiv · cs.AI
    VIA:通过视觉接口实现机器人控制的智能体

    VIA是一个通过视觉工作空间直接控制机器人的智能体框架,使用鼠标式工具探测像素并设置虚拟末端目标。论文摘要报告其在仿真中完成多样化桌面操作,并在真实移动操作机器人上完成导航与操作任务;两种设置均为零样本,无需机器人训练或额外动作原语,且性能随底层基础模型能力增强而提升。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。