跳到正文
arxiv.org(经 Hacker News)·· 19 天前AI 评分25

语言不可读性对 LLM 安全性的影响

语言不可读性对大型语言模型(LLM)安全性的影响

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

一项研究探讨语言不可读性对 LLM 安全性的影响,指出当输入文本对人类不可读时,模型的安全防护可能失效。该研究发表于 arXiv,聚焦语言层面的不可读性如何成为 LLM 安全的新隐患。

来源:arxiv.org(经 Hacker News) · arxiv.org