跳到正文
Hugging Face Daily Papers·· 27 天前AI 评分55

MOLE:检测 AI 智能体内部威胁的开放基准

MOLE: Detecting Insider Threats in AI Agents

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

研究团队发布 MOLE 开放基准,用 150 个 AI 运营账号、9 个有状态服务、30 个工作日和 12 类威胁,检验防守方能否在有限审查预算下从日常工作中识别内部威胁。

来源:Hugging Face Daily Papers · arxiv.org