Pelican-Sim 1.0:面向具身智能的通用世界模型模拟器
一份技术报告提出了 Pelican-Sim 1.0,这是一种根据视觉上下文和机器人动作预测未来观测结果的世界模型,用于支持后续学习和决策。其 28 维统一动作表示可适配多种机器人形态。系统结合渲染动作视频、稀疏混合专家层,以及经过蒸馏的四步生成流程,以提升可控性、视频质量和生成速度。模型使用约 100 万条真实和模拟轨迹进行训练,在多个机器人基准测试中超过了所评估的基线模型。在 RoboTwin 上,每个任务将 500 条生成轨迹加入 50 条示范后,策略成功率从 70% 提升至 93%。研究还报告了策略评估、动作选择和策略改进方面的性能提升。
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。