恶意软件开发者加入文本触发 LLM 安全拒答以规避检测
Malware devs added text to trigger LLM safety refusal, to avoid detection
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
据 jsrailton 的推文,恶意软件开发者会在恶意样本中加入特定文本,诱导 LLM 触发安全拒答,从而避开基于 LLM 的检测。该推文链接为 https://twitter.com/jsrailton/status/2064661778978533571。
来源:@jsrailton · X · x.com