标签后训练恢复可审查证据
热点事件观察中
标签后训练恢复可审查证据
1 篇报道1 个报道来源1 天前更新
先了解这件事
报道摘要
研究比较仅用判决标签进行后训练与拒绝采样,以恢复小语言模型生成的可审查证据。在ContractNLI上,仅标签训练达到准确率0.896和span F1 0.564,拒绝采样达到0.797和0.556;逐字引用率分别从0.597升至0.729和0.701。但该结果仅基于一个语料库和一个随机种子,不能据此判断哪种方法更优。
摘自 arXiv · cs.AI
最新进展10月7日 12:00
小语言模型在无标注证据下进行判决恢复:拒绝采样还是仅标签后训练?报道时间线
沿着报道,了解事件的不同侧面。
10月7日
- arXiv · cs.AI小语言模型在无标注证据下进行判决恢复:拒绝采样还是仅标签后训练?
研究比较仅用判决标签进行后训练与拒绝采样,以恢复小语言模型生成的可审查证据。在ContractNLI上,仅标签训练达到准确率0.896和span F1 0.564,拒绝采样达到0.797和0.556;逐字引用率分别从0.597升至0.729和0.701。但该结果仅基于一个语料库和一个随机种子,不能据此判断哪种方法更优。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。