🔮 Feed-Forward 3D — Explorer’s Map
3D 不再是离线拟合的目标,而是单次 transformer 前向就能输出的 tensor。
2020-2024 NeRF / 3DGS 是 per-scene 拟合;2024 DUSt3R 把成对前向打通;2025-2026 是 feed-forward foundation model 时代 — VGGT、VGGT-Ω、MapAnything 三件套互补,把 efficiency × dynamic × metric 三条核心轴各解一条;2026 streaming 子分支爆發(StreamVGGT → XStreamVGGT / OVGGT / FrameVGGT 4 個 follow-up),把第 4 條軸 online streaming 解了一半。
目前收录 9 篇深度解析 + 本 region 导读。
⚠ 2026-05 重要更新(GitHub deep dive):VGGT-Ω + StreamVGGT 都已開源但 Meta FAIR + 清華 release-and-forget 模式 — 15/25 open issue / 0 closed;production 候選看 follow-up papers(OVGGT O(1) constant memory / XStreamVGGT 4.42× memory ↓),不是原 repo。詳見 github_failure_atlas.md。
📍 三件套时间线 (2025-03 → 2026-05)
- MapAnything(2025-09 / 2026-01)解 metric scale — factored representation 把 (depth, ray, pose, scale) 分解
- VGGT-Ω(2026-05)解 efficiency + dynamic — register attention + 自监督 + 30% 训练内存
🔍 三件套对照(一眼看差异)
表 1 · 谁解了什么
表 2 · 输入 → 输出(上下游)
表 3 · 推理 / 部署
⚠️ License 警告:MapAnything CC-BY-NC-4.0 商用要谈许可;与 VGGT 谱系(likely Apache)的差异是 deployment 决策。
表 4 · 哪些问题谁都没解
关键含义:feed-forward 3D 谱系在 2025-2026 取得了 metric + efficiency + dynamic 三个轴的进展,但 aerial 实时控制环的硬约束(streaming + IMU + sub-10ms latency)一个也没解。所以
crossing/slam-vio-migration/vggt_vs_drone_vio.md 结论:hybrid VGGT(任意变体) + 经典 VIO,不是替换 — 仍成立。
🎯 我该选哪个?(5 秒决策树)
📖 九篇深度解析(全收录)
🌐 与其他区的边界
← Back to Foundations · → 3DGS family · → NeRF family · → classical SLAM