Long-WAM扩展机器人实时动作上下文
热点事件持续更新
Long-WAM扩展机器人实时动作上下文
1 篇报道1 个报道来源17 小时前更新
先了解这件事
AI 综述
Wei Huang等提出并评估Long-WAM,在实时机器人控制中扩展因果世界—动作模型的视觉上下文。基于论文摘要,该系统在RoboCasa GR-1上将上下文由0.0秒增至19.2秒,成功率从63.3%升至78.7%;在20次测试中,Pi0.5和Fast-WAM均未成功,而Long-WAM在LIBERO-Long、RoboTwin 2.0和DOMINO的对比方法中取得最佳结果。 Long-WAM采用流式观测编码、异步执行和硬件特定加速,可在RTX 5090、DGX Spark和Jetson AGX Thor部署且保留未来预测;RTX 5090上每个包含未来视频潜变量预测的动作块耗时107.4毫秒。双向预训练初始化没有带来净增益。
AI 根据报道生成 · 1 小时前更新
最新进展10月8日 01:58
Long-WAM在实时机器人控制中扩展世界—动作模型上下文报道时间线
沿着报道,了解事件的不同侧面。
10月8日
- arXiv · cs.AILong-WAM在实时机器人控制中扩展世界—动作模型上下文
Long-WAM通过流式观测编码、异步执行和硬件特定加速,在实时机器人控制约束下扩展因果世界—动作模型的视觉上下文。基于论文摘要,在RoboCasa GR-1上将上下文从0.0秒增至19.2秒,成功率从63.3%升至78.7%,而双向预训练初始化没有净增益。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。