论文披露 Anthropic、OpenAI、Google 的 API 加密推理可被小模型转录,Kimi-K3 复现概率异常
年度AI论文!全球三大顶尖模型的防蒸馏机制全面告破:小模型“套出”大模型隐藏思维链,Kimi-K3重现概率异常
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
一篇由 MATS program 研究员 Alexander Panfilov 领衔、马克斯·普朗克智能系统研究所等机构联合发表的论文披露,Anthropic、OpenAI、Google 的 API 存在密码学旁路漏洞,攻击者用轻量级模型配合越狱提示词,就能把加密推理块转录为明文思维链。
来源:AI前线 · 微信公众号 · mp.weixin.qq.com