SpanCalib-VLM:视觉语言模型中的校准幻觉片段检测
SpanCalib-VLM: Calibrated Hallucination Span Detection in Vision-Language Models
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
SpanCalib-VLM 提出一种双系统混合方案,用于视觉语言模型的幻觉片段检测:将 XLM-RoBERTa-Large 与 SigLIP 视觉编码器经交叉注意力融合的多模态序列标注器,与微调生成式 VLM(Qwen3.5-4B-SHROOM-SFT)结合,通过 Union-Calibrated Fusion 策略用标注器的校准概率对生成模型的候选片段重新打分。
来源:Hugging Face Daily Papers · arxiv.org