跳到正文
热点事件持续更新

何恺明团队发布VISTA视觉Harness论文

1 篇报道1 个报道来源11 小时前更新

先了解这件事

AI 综述

何恺明团队发布论文《VISTA: A Visual Harness for Reasoning in an Interactive World》,提出视觉原生Harness,通过视觉观察、无损视觉记忆和主动视觉检查,让现有多模态模型在连续交互中保存原始帧、按需检索、放大并比较细节,无需重新训练新模型。 据论文报告,配合VISTA的Claude Opus 5.0完成了ARC-AGI-3全部25个公开游戏,在人类相对动作效率指标上拿到满分100;使用同一GPT-5.6 Sol模型,VISTA使GameWorld 170个任务的成功率从官方基线框架的40.0%提升到63.3%。

AI 根据报道生成 · 46 分钟前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. 36Kr Europe · English
    VISTA:让多模态模型在交互中记忆并复查视觉经验

    Kaiming He团队在VISTA论文中提出视觉原生Harness,通过视觉观察、无损视觉记忆和主动视觉检查,让现有多模态模型在连续交互中保存原始帧、按需检索、放大并比较细节,无需从头重新训练。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。