跳到正文
arXiv · cs.AI· Avrile Floro, Tamara Dhorasoo, Soline Pellez, Nils Holzenberger·· 1 天前

专家分歧揭示模型识别法国法院判决隐含法律引证的局限

Where Experts Disagree, Models Fail: Detecting Implicit Legal Citations in French Court Decisions

arXiv:2603.22973v3阅读论文 PDF ↗

仅依据论文摘要整理;未读取全文,实验条件、证明与基准细节请核对原文。

作者:Avrile Floro, Tamara Dhorasoo, Soline Pellez, Nils Holzenberger

研究任务与主要进展

作者发布法国《民法典》隐含引证识别基准,由三位法律专家标注1,015组“段落—法条”对;专家争议的三分之一案例正是模型失败集中的区域。研究评估的10个模型中,最佳集成的总体F1为0.70,三分之二误报集中在争议案例;将同一信号改写为多模型共识的Top-k排序后,基准前200名候选达到76%精度,且无需监督。

阶段、条件与复现 · 深读核对

  • 新能力对应什么具体任务与最小输入输出?
  • 代码、模型、数据、许可与可用入口是否明确?
  • 效果、总成本、失效条件与实际工作流如何验证?

这些是阅读核对问题;材料未说明的条件保留未知。请结合上方论文版本、资料范围与原文核验。

来源:arXiv · cs.AI · arxiv.org