研究:LLM 能识别错误判例,却难以发现引用页码与论点不符
Is this Citation on Point?
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
一项被 ICML 2026 AI for Law 研讨会接收的研究用真实法律引用做受控扰动,测试了 14 种模型配置的引用支持验证能力。模型能识别 93-100% 的错判例引用,但只发现 37-61% 的法院判决书错页码引用和 52-83% 的法律文书错页码引用。GPT-5.4 高推理强度仍漏掉法院判决书中 40%、法律文书中 18% 的页码不匹配,模型往往依据主题相关而非页面级支持就接受引用。
来源:Hugging Face Daily Papers · arxiv.org