PRISK 框架评估大语言模型个性化隐藏成本:13 个 LLM 测试揭示三类风险
Evaluating the Hidden Costs of Personalization in Large Language Models
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
研究者提出 PRISK 动态评估框架,用于系统检测 LLM 个性化的副作用,覆盖无关个性化、偏好窄化和谄媚偏见三类风险。在 13 个 LLM 上的实验显示,用户画像与检索记忆会持续加剧这些偏见,三项指标平均分别下降 45.9%、41.7% 和 61.7%。
来源:Hugging Face Daily Papers · arxiv.org