跳到正文
arxiv.org(经 Hacker News)·· 2026-08-11AI 评分27

EvoHarnessRL:为长时程 LLM 智能体学习自演化运行时 Harness

EvoHarnessRL: Learning Self-Evolving Runtime Harness for Long-Horizon LLM Agents

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

EvoHarnessRL 提出为长时程 LLM 智能体学习可自演化的运行时 Harness,让智能体在运行过程中动态调整自身的执行框架。该方法面向需要多步、长时间跨度的智能体任务,试图解决固定 Harness 难以适应复杂长时程场景的问题。

来源:arxiv.org(经 Hacker News) · arxiv.org