新研究发现 AI 模型写出的推理步骤对应不同的内部模式
AI models' written reasoning steps correspond to distinct internal patterns, a new study finds
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
一项新研究发现,计算、公式检索和演绎等推理步骤在模型内部状态中可清晰分离,尤其在中层。这意味着模型处理的信息多于其可见思维链所展示的内容,对 AI 安全具有意义。
来源:The Decoder · the-decoder.com