SPATIALUNCERTAIN评测视觉语言模型能否识别空间问题证据不足
SPATIALUNCERTAIN提出一个评估视觉语言模型能否识别空间问题中视觉证据不可靠的框架,重点研究遮挡造成的缺失证据和透视造成的误导证据。基于论文摘要,八个开源与闭源模型未能在证据消失时更谨慎,在透视冲突下反而更多依赖二维投影外观;提示和微调未能完全解决这些问题。
动态展示门槛:AI 前沿与应用 ≥ 65 分,量子方向 ≥ 60 分;已确认精选照常展示。
SPATIALUNCERTAIN提出一个评估视觉语言模型能否识别空间问题中视觉证据不可靠的框架,重点研究遮挡造成的缺失证据和透视造成的误导证据。基于论文摘要,八个开源与闭源模型未能在证据消失时更谨慎,在透视冲突下反而更多依赖二维投影外观;提示和微调未能完全解决这些问题。