Robbyant/lingbot-map
[ECCV 2026 Best Paper Award Candidate] LingBot-Map: Geometric Context Transformer for Streaming 3D Reconstruction
深度介绍
它是什么
LingBot-Map 是蚂蚁灵波团队开源的前馈式流式三维重建模型,论文入选 ECCV 2026 最佳论文候选。它用几何上下文 Transformer 直接从视频流中增量恢复场景结构,无需逐场景优化。
核心亮点
- 流式推理:边看边建,天然适配机器人与 AR 场景
- 几何上下文注意力:在长序列中保持跨帧几何一致性,抑制漂移
- 前馈架构:单次前向出结果,比传统 SfM/NeRF 管线快一个量级
- Apache-2.0:商用友好,代码与权重齐备
为什么火
三维重建长期在"精度"与"实时"之间二选一。LingBot-Map 用 Transformer 把两者拉近,加上 ECCV 背书与宽松协议,单日涨星破百,一周内冲上近 1.8 万星。
适合谁用
做 SLAM、具身智能、AR/VR 的算法工程师,以及需要在线重建能力的机器人团队。
快速上手
git clone https://github.com/Robbyant/lingbot-map
pip install -r requirements.txt
python demo.py --input your_video.mp4
建议从官方 demo 视频跑通,再接入自有数据流。
