跳到正文
Hugging Face Daily Papers·· 29 天前AI 评分45

KoNA:评估视觉语言模型的选择性不服从基准

Knowing What Not to Answer: Selective Non-Compliance in Vision-Language Models

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

研究者提出 KoNA 基准,用于评估视觉语言模型(VLM)的选择性不服从能力,涵盖 False Premise、Visual Inaccessibility、Universal Unknown、Task Feasibility 和 Safety 五类任务,每类同时考察查询级与组件级不服从。

来源:Hugging Face Daily Papers · arxiv.org