跳到正文
Hugging Face Daily Papers·· 2026-08-18AI 评分45

研究:LLM 能识别错误判例,却难以发现引用页码与论点不符

Is this Citation on Point?

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

一项被 ICML 2026 AI for Law 研讨会接收的研究用真实法律引用做受控扰动,测试了 14 种模型配置的引用支持验证能力。模型能识别 93-100% 的错判例引用,但只发现 37-61% 的法院判决书错页码引用和 52-83% 的法律文书错页码引用。GPT-5.4 高推理强度仍漏掉法院判决书中 40%、法律文书中 18% 的页码不匹配,模型往往依据主题相关而非页面级支持就接受引用。

来源:Hugging Face Daily Papers · arxiv.org