跳到正文
Hugging Face Daily Papers·· 21 天前AI 评分45

RSIAgent:在新环境中通过自主记忆构建实现递归自我改进

RSIAgent: Autonomous Exploration for Recursive Self-improvement in New Environments

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

研究团队提出免训练多智能体框架 RSIAgent,通过课程、执行与验证三类智能体协同探索环境,构建可复用的因果记忆,并采用"先广后深"的探索策略。在 OSWorld-v2 和 Agent's Last Exam 上,RSIAgent 显著提升开源模型表现,使 Kimi-K3 和 GLM-5.3 超越 GPT-6 等前沿闭源模型。

来源:Hugging Face Daily Papers · arxiv.org