Hugging Face Daily Papers·· 1 天前AI 评分44
InterEvolve:人形机器人移动操作中奖励程序的测试时进化
InterEvolve: Test-Time Evolution of Reward Programs for Humanoid Loco-Manipulation
AI 导读
InterEvolve 提出一种测试时进化方法,让人形机器人控制器无需重新训练即可通过重编程现有技能解决新任务。它用 LLM 智能体在上下文中修订奖励程序结构,并由数值优化器调整常数,在并行仿真中验证候选程序。实验表明,InterEvolve 进化出的程序释放了 FB 模型未被充分利用的移动操作能力,进化技能可在物理 Unitree G1 上自主运行。
来源:Hugging Face Daily Papers · arxiv.org