跳到正文
热点事件观察中

标签后训练恢复可审查证据

1 篇报道1 个报道来源1 天前更新

先了解这件事

报道摘要

研究比较仅用判决标签进行后训练与拒绝采样,以恢复小语言模型生成的可审查证据。在ContractNLI上,仅标签训练达到准确率0.896和span F1 0.564,拒绝采样达到0.797和0.556;逐字引用率分别从0.597升至0.729和0.701。但该结果仅基于一个语料库和一个随机种子,不能据此判断哪种方法更优。

摘自 arXiv · cs.AI

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. arXiv · cs.AI
    小语言模型在无标注证据下进行判决恢复:拒绝采样还是仅标签后训练?

    研究比较仅用判决标签进行后训练与拒绝采样,以恢复小语言模型生成的可审查证据。在ContractNLI上,仅标签训练达到准确率0.896和span F1 0.564,拒绝采样达到0.797和0.556;逐字引用率分别从0.597升至0.729和0.701。但该结果仅基于一个语料库和一个随机种子,不能据此判断哪种方法更优。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。