EVOKE:激发智能体的世界知识,实现可迁移的决策
大型语言模型智能体往往难以将已有行为迁移到陌生环境。EVOKE 是一种后训练方法,旨在更有效地利用模型在预训练中获得的世界知识。该方法固定环境状态和交互历史,并根据不同目标对候选行动进行排序。在多种任务和三种基础模型上的评估显示,EVOKE 提升了任务表现、对未见环境的泛化能力以及数据效率。
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。