跳到正文
原文
Hugging Face Daily Papers·· 1 天前AI 评分47

后训练中的锐化税:预训练 LLM 配轻量推理框架即可胜任智能体任务

Sharpening Tax in Post-Training

AI 导读

研究发现,预训练 LLM 搭配轻量推理框架即可作为智能体使用,其 pass@1 准确率虽远低于后训练版本,但在充足测试时预算下 pass@K 解题覆盖率常反超后训练模型。

来源:Hugging Face Daily Papers · arxiv.org