原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arxiv.org/abs/2609.38334
立即前往原文

EVOKE:激发智能体的世界知识,实现可迁移的决策

大型语言模型智能体往往难以将已有行为迁移到陌生环境。EVOKE 是一种后训练方法,旨在更有效地利用模型在预训练中获得的世界知识。该方法固定环境状态和交互历史,并根据不同目标对候选行动进行排序。在多种任务和三种基础模型上的评估显示,EVOKE 提升了任务表现、对未见环境的泛化能力以及数据效率。
行业资讯 应用 AI模型 研究 2026-10-01 15:00:55 651 阅读 阅读约 1 分钟 来源:Hugging Face
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。