跳到正文
arXiv · cs.AI· Baoteng Li, Wenzhuo Wu, Kongming Liang, Zhanyu Ma·· 2 天前

Visual Jev 奖励:面向多主体图像生成的参考绑定验证

Visual Jev Rewards: Reference-Bound Verification for Multi-Subject Image Generation

arXiv:2610.09328v1阅读论文 PDF ↗

仅依据论文摘要整理;未读取全文,实验条件、证明与基准细节请核对原文。

作者:Baoteng Li, Wenzhuo Wu, Kongming Liang, Zhanyu Ma

首次提交:2026-10-07 10:34

研究任务与主要进展

Visual Jev 奖励将参考身份与属性、动作和关系联合验证,并转化为生成器训练信号。基于 200 个 MICo-150K 训练任务训练 Qwen3.5-4B 验证器后,经过 30 次更新,GPT-5.4 在人工选定的 897 项 MICo-Bench 子集上综合得分由 41.78 升至 52.50,直接使用 27B 奖励则得 51.84;离线人工评估未显示相对直接评分的显著优势。

阶段、条件与复现 · 深读核对

  • 新能力对应什么具体任务与最小输入输出?
  • 代码、模型、数据、许可与可用入口是否明确?
  • 效果、总成本、失效条件与实际工作流如何验证?

这些是阅读核对问题;材料未说明的条件保留未知。请结合上方论文版本、资料范围与原文核验。

来源:arXiv · cs.AI · arxiv.org