跳到正文
HuggingFace Daily Papers·· 1 天前AI 评分43

超越记忆:用显式信念状态驱动长时程 LLM 智能体

Beyond Memory: Harnessing Long-Horizon Agents with Explicit Belief States

AI 导读

研究者提出推理时框架 PoS,为 LLM 智能体构建并持续维护显式信念状态作为决策上下文,每个信念结合当前世界状态估计与未解决的任务需求。PoS 通过一致性校验和任务进度监控检测“Belief Trapping”,并按陷阱模式与未满足需求类型定制恢复策略。在覆盖执行与诊断的四项基准上,PoS 在三种 LLM 主干下均取得最高整体表现,消融实验验证了一致性校验与恢复机制的必要性。

来源:HuggingFace Daily Papers · arxiv.org