跳到正文
Hugging Face Daily Papers·· 2026-09-01AI 评分43

AutoSciRub:为自动科研智能体自动归纳评估标准

Learning to Evaluate Before Improving: Automatic Rubric Induction for Automatic Research Agents

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

研究团队提出 AutoSciRub,一个"先评估后执行"的框架,在科研执行前为任务自动生成可执行评分标准,用于指导实验、逐条验证与迭代修订。

来源:Hugging Face Daily Papers · arxiv.org