AutoSciRub:为自动科研智能体自动归纳评估标准
Learning to Evaluate Before Improving: Automatic Rubric Induction for Automatic Research Agents
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
研究团队提出 AutoSciRub,一个"先评估后执行"的框架,在科研执行前为任务自动生成可执行评分标准,用于指导实验、逐条验证与迭代修订。
来源:Hugging Face Daily Papers · arxiv.org