Anthropic 论文揭示 Claude 内部存在 J 空间,DeepMind 研究员在开源模型上复现
Claude“脑内小剧场”首曝光:隐藏工作空间自发涌现类人意识,谷歌 DeepMind 权威认证!
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
Anthropic 发布研究论文《可言说表征在语言模型中形成全局工作空间》,称通过新的可解释性工具 Jacobian 透镜(J-lens)发现 Claude 内部存在一个规模较小、一次仅容纳几十个概念的 J 空间,概念在其中可被报告、调节和推理,而不必输出为语言。
来源:InfoQ · 微信公众号 · mp.weixin.qq.com