恶意软件开发者加入文本触发 LLM 安全拒答以规避检测
据 jsrailton 的推文,恶意软件开发者会在恶意样本中加入特定文本,诱导 LLM 触发安全拒答,从而避开基于 LLM 的检测。该推文链接为 https://twitter.com/jsrailton/status/2064661778978533571。
@jsrailton · X · 历史来源 · 当前未持续收录
据 jsrailton 的推文,恶意软件开发者会在恶意样本中加入特定文本,诱导 LLM 触发安全拒答,从而避开基于 LLM 的检测。该推文链接为 https://twitter.com/jsrailton/status/2064661778978533571。