论文发现 LLM 能识别结构性无解问题却仍作答,原因在拒答通路错位
Recognition-Refusal Misalignment in LLMs: Why Models Answer Structurally Unanswerable Questions
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
一项被 EMNLP 2026 主会接收的研究发现,1.7B 至 70B 的指令微调模型中存在一条隐藏状态线性方向,能区分可答问题与结构性无解的数学和代码提示,说明模型在生成前已表征出问题无解。
来源:Hugging Face Daily Papers · arxiv.org