MOLE:检测 AI 智能体内部威胁的开放基准
MOLE: Detecting Insider Threats in AI Agents
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
研究团队发布 MOLE 开放基准,用 150 个 AI 运营账号、9 个有状态服务、30 个工作日和 12 类威胁,检验防守方能否在有限审查预算下从日常工作中识别内部威胁。
来源:Hugging Face Daily Papers · arxiv.org
MOLE: Detecting Insider Threats in AI Agents
本站未展示全文,请前往来源网站阅读。
研究团队发布 MOLE 开放基准,用 150 个 AI 运营账号、9 个有状态服务、30 个工作日和 12 类威胁,检验防守方能否在有限审查预算下从日常工作中识别内部威胁。
来源:Hugging Face Daily Papers · arxiv.org