原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arxiv.org/abs/2609.05416
立即前往原文

WorldSculpt:从带定位信息的视频生成组合式世界

WorldSculpt提出了一种生成组合式3D场景表示的方法,可处理包含数百个物体的杂乱场景。该方法扩展了单物体3D生成模型Pixal3D,加入多视图条件模块,通过多个带姿态信息的观测来约束生成的物体网格。模型仅使用标准空间中的单个物体进行微调,却无需场景级训练即可推广到遮挡严重的大型场景。研究人员还推出了逼真的基准数据集UE-MeshyScene,其中包含逐物体标注和真实网格。在单物体、受控多物体及复杂场景测试中,该方法均优于以往方案;场景越复杂、遮挡越严重,性能提升越明显。
行业资讯 应用 AI模型 研究 2026-09-07 10:01:05 809 阅读 阅读约 1 分钟 来源:Hugging Face
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。