原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arxiv.org/abs/2608.12571
立即前往原文

这条引文真的支持该主张吗?

一项新研究评估了大型语言模型核验法律引文是否真正支持相关主张的能力。模型能够识别93%至100%的错误判例引用,但对法院判决中仅页码错误的引文,识别率只有37%至61%;在法律文书中则为52%至83%。即使采用高推理强度的GPT-5.4,在法院判决中仍会漏掉40%的页码不匹配,在法律文书中会漏掉18%。模型出错时,往往依据主题相似性作出判断,而不是核对被引用页面的具体内容。要求模型验证指定页面可以提高召回率,但也会增加误报。研究表明,识别法律主题与验证引文是否支持具体主张,是当前模型尚未充分区分的两种能力。
行业资讯 应用 伦理与安全 研究 2026-08-18 07:30:54 888 阅读 阅读约 1 分钟 来源:Hugging Face
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。