研究将提示词注入归因于 LLM 角色混淆
Prompt Injection as Role Confusion
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
Charles Ye、Jasmine Cui 和 Dylan Hadfield-Menell 的研究把提示词注入归因于 LLM 的角色混淆,认为模型更看重文本风格而非 <system>、<user> 这类角色标签,因此难以区分自身特权文本与不可信用户输入。
来源:Simon Willison · simonwillison.net