跳到正文
Hugging Face Daily Papers·· 2026-08-19AI 评分37

无标签策略下准确率与顺序敏感性出现分化

Accuracy and Order Sensitivity Diverge Under Label-Free Strategies

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

一项针对大语言模型多选题基准的研究发现,阻止模型看到选项标签并不能可靠提升准确率。研究测试了生成后匹配与单独打分两种去偏策略,完整分解显示瓶颈在于隐藏选项而非匹配步骤;唯一能稳定匹配基线的配置是展示全部选项并配合 LLM 匹配器。完全消除位置影响仍未带来稳定准确率增益,而循环置换往往能提升表现。

来源:Hugging Face Daily Papers · arxiv.org