跳到正文
原文
HuggingFace Daily Papers·· 3 天前AI 评分39

EVOKE:在智能体中激发世界知识以实现可迁移决策

EVOKE: Eliciting World Knowledge in Agents for Transferable Decision-Making

AI 导读

针对 LLM 智能体在多步决策中难以迁移到未见环境的问题,研究者提出后训练方法 EVOKE,通过在固定状态下引入目标多样性,迫使同一候选动作在不同目标下重新排序,从而激发预训练中已内化的世界知识。在三种骨干模型的多类任务上,EVOKE 提升了任务表现、未见环境泛化能力与数据效率。

来源:HuggingFace Daily Papers · arxiv.org