跳到正文

安全对齐

AI 安全与对齐:越狱与防御、模型行为研究、安全评测与治理框架的进展。

当前仅显示精选新闻
243条精选相关主题论文研究政策监管推理能力

最新精选

第 241–243 条 · 共 243 条
8月20日周二
  1. PromptArmor:Threat Intelligence72

    PromptArmor 披露 Slack AI 可经间接提示词注入窃取私有频道数据

    PromptArmor 披露 Slack AI 存在间接提示词注入漏洞,攻击者在公开频道发布恶意指令,即可诱使 Slack AI 将用户私有频道中的 API 密钥等敏感数据嵌入钓鱼链接并渲染给用户,且引用不显示攻击者消息导致难以追踪。

    推荐理由:原文给出了完整的攻击链和可操作的缓解设置,读者可以据此评估自己工作区里 Slack AI 的暴露面。

8月1日周四
  1. Suno Blog70

    Suno 回应唱片业诉讼,称模型训练属学习而非侵权

    Suno 发文回应 RIAA 代表三大唱片公司于 6 月 24 日提起的版权诉讼,称诉讼在事实和法律上均有缺陷,训练数据来自开放互联网上的中高质量音乐。Suno 还表示已设置阻止上传受版权内容、禁止按艺术家名生成等防抄袭机制,且起诉时双方正进行商业谈判。

    推荐理由:Suno 官方回应 RIAA 诉讼,阐述其训练数据立场和防抄袭机制,可了解生成式音乐版权争议一方的核心论点。

12月20日周三