从 12 帧开始重建一万帧场景

8 月 28 日,高德宣布开源 ABot-Recon,称其为首个无长程依赖的万帧级流式 3D 重建模型。它只依赖前 12 帧即可启动重建,随后以流式方式持续更新,实现边拍边建:视频拍到哪,场景模型建到哪,不需要等整段视频结束。

在 Oxford Spires 基准上,ABot-Recon 的轨迹误差较 LingBot-Map 降低 40.6%,RPE-R 为 0.12°;KITTI-02 上达到 24.45FPS。峰值显存约 6.71GB,官方称 GTX 1080Ti 级别的显卡即可运行,输入为单目 RGB 视频。代码与模型已开源,魔搭社区提供在线体验。

  • 首个无长程依赖的万帧级流式 3D 重建模型
  • 12 帧启动、流式更新,边拍边建
  • Oxford Spires 轨迹误差较 LingBot-Map 降 40.6%,RPE-R 0.12°
  • 峰值显存约 6.71GB,GTX 1080Ti 可跑,输入单目 RGB
  • 已开源:github.com/amap-cvlab/ABot-Recon
流式重建的价值在具身智能场景:机器人边走边建图,而不是先录完一整段再离线处理。