跳到正文
Hugging Face Daily Papers·· 2026-08-21AI 评分43

Chain-of-Experience:让 LLM 在推理时持续自我改进

Chain-of-Experience for Continual LLM Improvement

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

研究提出 Chain-of-Experience(CoE),让 LLM 在测试时通过自我反馈或环境信号(如正确性、公开代码测试通过率)迭代积累经验,形成持续改进循环。在数学、编程和知识任务上测试 8 个 LLM(含 GPT-5、Gemini-2.5 Pro、Claude-4.5 Sonnet),整体提升 5.6%,API 成本降低 19%,且每 token 准确率高于现有测试时策略。

来源:Hugging Face Daily Papers · arxiv.org