跳到正文
Hugging Face Daily Papers·· 27 天前AI 评分50

论文发现 LLM 能识别结构性无解问题却仍作答,原因在拒答通路错位

Recognition-Refusal Misalignment in LLMs: Why Models Answer Structurally Unanswerable Questions

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

一项被 EMNLP 2026 主会接收的研究发现,1.7B 至 70B 的指令微调模型中存在一条隐藏状态线性方向,能区分可答问题与结构性无解的数学和代码提示,说明模型在生成前已表征出问题无解。

来源:Hugging Face Daily Papers · arxiv.org