跳到正文
@perplexity_ai· @perplexity_ai · X·· 27 天前AI 评分41
AI 导读

真实的检索评测需要大规模语料和查询集,以及深入的相关性标注来减少假阴性。 Q2D-Web 在其合并集合中结合了 1.9 亿篇网页文档、69,721 条智能体重构查询,平均每条查询有 99.6 条正例标注。https://t.co/FRCuZUFQQv

正文

Realistic retrieval evaluation requires large corpora and query sets, with deep relevance judgments to reduce false negatives.

Q2D-Web combines 190M web documents, 69,721 agent-reformulated queries, and 99.6 positive judgments per query on average in its combined set. https://t.co/FRCuZUFQQv

来源:@perplexity_ai · x.com