原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arxiv.org/abs/2608.30821
立即前往原文

Lucida:解析、生成并放置物体,实现可组合的真实场景到仿真建模

Lucida是一种将真实室内环境重建为完整、可编辑三维物体资产的方法,面向机器人仿真和具身智能。系统首先构建场景图,为每个物体保留多视角证据;随后根据这些证据生成完整资产,并通过GizmoAct完成物体放置。视觉语言模型以闭环GUI交互的方式控制放置过程,并自行判断对齐是否达到要求。根据论文作者报告,Lucida在R2S-Scene上的mAP较Boxer提升69%;在CA-1M上,ADD-SB@0.05从57.8%提高到83.4%;场景F-Score也从SAM3D的0.794提升至0.924。
行业资讯 应用 研究 2026-09-01 12:30:57 817 阅读 阅读约 1 分钟 来源:Hugging Face
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。