原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arxiv.org/abs/2609.04201
立即前往原文

Scal3R:面向可扩展在线三维重建的高效多重相对位姿查询

在线三维重建模型在处理长视频时通常会出现性能下降,因为相对于固定的第一帧进行位姿回归会迫使模型超出训练分布进行外推。Scal3R改为相对于多个历史关键帧查询位姿。该方法通过非对称注意力,将约占参数量1%的轻量级可学习令牌注入完全冻结的骨干网络。带有闭环检测的在线位姿图优化系统可抑制长距离漂移。作者称,该模型在单张GPU上可于8小时内收敛,在KITTI上相比在线基线将平均ATE降低60%以上,并在多个数据集上达到当前最佳性能。
行业资讯 应用 AI模型 研究 2026-09-04 16:31:14 241 阅读 阅读约 1 分钟 来源:Hugging Face
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。