跳到正文
Hugging Face Daily Papers·· 1 天前AI 评分46

准确但不谦逊:评估知识冲突下 LLM 智能体的认知谦逊

Accurate but Not Humble: Evaluating Epistemic Humility in LLM Agents under Knowledge Conflict

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

研究提出用"认知谦逊"(EH)评估 LLM 智能体在知识冲突下的表现,通过 Identify、Solve、Escalate(ISE)三个轨迹级行为维度,在受控冲突和多步执行中的自然冲突两种设定下评测四款智能体。

来源:Hugging Face Daily Papers · arxiv.org