原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arxiv.org/abs/2609.15195
立即前往原文

HarnessVLN 通过智能体框架统一无需训练的具身导航

HarnessVLN 是一个零样本具身导航框架,无需额外训练即可利用多模态大语言模型。其统一的智能体接口协调感知、检索、定位、导航、故障恢复和任务终止。系统根据空间证据、几何可行性以及子目标一致性,对规划器提出的行动进行验证。分层事件记忆用于跟踪任务进度和执行历史,持久化时空图则保存可复用的空间证据与失败标注。在 R2R、RxR、HM3D-v2 和 HM3D-OVON 基准上,HarnessVLN 分别取得 60.8%、53.9%、76.0% 和 59.3% 的成功率,超过此前无需训练方法的最佳结果。研究还通过人形机器人在真实环境中展示了其执行指令跟随和物体目标导航任务的能力。
行业资讯 应用 研究 2026-09-16 17:30:59 820 阅读 阅读约 1 分钟 来源:Hugging Face
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。