跳到正文
Hugging Face Daily Papers·· 2026-08-18AI 评分51

COLM 2026 论文:思维模型放大的推理行为并非高预测性行为

Amplified Does Not Mean Predictive: Reasoning Behaviors in Thinking Models

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

发表于 COLM 2026 的研究在 15 个模型、6 个基准上标注 15,282 条推理轨迹,提出 Behavioral Lift 指标衡量某行为出现与否时正确率的变化。研究发现思维模型显著放大自我纠错、假设检验和不确定性承认,而提升正确率最高的行为是置信度校准、知识对齐和自我意识。置信度校准是最强的正向正确率信号之一却几乎未被放大,不确定性承认被放大 3 至 7 倍却与正确率弱相关或负相关。

来源:Hugging Face Daily Papers · arxiv.org