原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arxiv.org/abs/2609.38078
立即前往原文

MotorMind:利用通用视觉语言模型实现零样本机器人操作

MotorMind 将视觉语言模型提出的中间层动作与确定性机器人控制及执行反馈相连接。在不进行任务专属策略训练、不使用编程智能体或额外视觉定位工具的情况下,系统在 LIBERO-PRO 上的成功率为 66.7%,在扰动条件下为 53.8%。在真实 xArm6 机器人上,平均成功率达到 95%。结果表明,通用视觉语言模型配合适当的动作表示和执行框架,可以完成零样本机器人操作任务。
行业资讯 应用 研究 2026-10-05 13:01:05 510 阅读 阅读约 1 分钟 来源:Hugging Face
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。