跳到正文
热点事件观察中

发布双语视觉文字生成基准

1 篇报道1 个报道来源1 天前更新

先了解这件事

报道摘要

作者提出 UltraText Bench,用于评测图像生成模型在中英双语密集视觉文本中的持续渲染能力。基准包含432个提示词、24类真实场景和三个难度等级,每条提示词规定4至12个文本区域及位置、视觉属性;研究使用 Q-Judger 评估24种模型配置,并在10人参与下进行人工评测。

摘自 arXiv · cs.AI

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. arXiv · cs.AI
    UltraText Bench:面向图像生成密集视觉文本渲染的中英双语评测基准

    作者提出 UltraText Bench,用于评测图像生成模型在中英双语密集视觉文本中的持续渲染能力。基准包含432个提示词、24类真实场景和三个难度等级,每条提示词规定4至12个文本区域及位置、视觉属性;研究使用 Q-Judger 评估24种模型配置,并在10人参与下进行人工评测。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。