Hugging Face Blog·· 2026-06-19精选AI 评分62
MosaicLeaks 基准提出 PA-DR 训练法,把研究智能体的隐私泄露从 34.0% 降到 9.9%
MosaicLeaks: Can your research agent keep a secret?
AI 导读
MosaicLeaks 提出一项深研究任务,用交错公开与私密信息的多跳问题衡量研究智能体外部查询的隐私泄露,并定义意图、答案、全信息三类泄露指标。团队提出的 Privacy-Aware Deep Research(PA-DR)训练法把严格链成功率从 48.7% 提升到 58.7%,同时把答案或全信息泄露从 34.0% 降到 9.9%。
推荐理由
材料把智能体的外部查询日志视为泄露通道,量化三类泄露,并显示提示词难以约束、需靠训练才能把泄露压低三倍多。
来源:Hugging Face Blog · huggingface.co