混合模态检索器中的模态偏好:文本干扰为何比图像更致命
Chaos in the Text: Revealing the Modality Preference in Mixed-Modality Retrievers
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
研究发现密集检索器在文本、图像及融合文档共存的混合语料上性能呈V形曲线,单模态语料表现强,模态共存时显著下降,且无关文本比等量无关图像造成更严重退化,该现象被命名为"Chaos in the Text"。
来源:Hugging Face Daily Papers · arxiv.org