Hugging Face Daily Papers·· 1 天前AI 评分40
PoS:用显式信念状态增强长时程 LLM 智能体
Beyond Memory: Harnessing Long-Horizon Agents with Explicit Belief States
AI 导读
研究者提出推理时框架 PoS,为 LLM 智能体构建并持续维护显式信念状态作为决策上下文,每个信念结合当前世界状态估计与未解决的任务需求。PoS 通过一致性校验和任务进度监控检测“Belief Trapping”,并按陷阱模式与未满足需求类型进行恢复。在四个覆盖执行与诊断的基准上,PoS 在三种 LLM 主干下均取得最高整体表现,消融实验验证了一致性校验与恢复机制的作用。
来源:Hugging Face Daily Papers · arxiv.org