KoNA:评估视觉语言模型的选择性不服从基准
Knowing What Not to Answer: Selective Non-Compliance in Vision-Language Models
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
研究者提出 KoNA 基准,用于评估视觉语言模型(VLM)的选择性不服从能力,涵盖 False Premise、Visual Inaccessibility、Universal Unknown、Task Feasibility 和 Safety 五类任务,每类同时考察查询级与组件级不服从。
来源:Hugging Face Daily Papers · arxiv.org