Adaptive World Memory 3D Foundation Model for Scalable 3D Mapping, Localization, and Rendering
cs.CV, cs.RO
Submitted: 2026-09-18
Updated: 2026-09-18
Code: https://github.com/dtc111111/AWM-3DFM
Terminology
Sources
- $\pi^3$: Permutation-Equivariant Visual Geometry Learning
- What Is The Best 3D Scene Representation for Robotics? From Geometric to Foundation Models
- Streaming 4D Visual Geometry Transformer
- InfiniteVGGT: Visual Geometry Grounded Transformer for Endless Streams
- 3D Reconstruction with Spatial Memory
- Continuous 3D Perception Model with Persistent State
- TTSA3R: Training-Free Temporal-Spatial Adaptive Persistent State for Streaming 3D Reconstruction
- GS-SLAM: Dense Visual SLAM with 3D Gaussian Splatting
- Compact 3D Gaussian Splatting For Dense Visual SLAM
- AMB3R: Accurate Feed-forward Metric-scale 3D Reconstruction with Backend
- Mamba: Linear-Time Sequence Modeling with Selective State Spaces
- Learning to (Learn at Test Time): RNNs with Expressive Hidden States
- GRS-SLAM3R: Real-Time Dense SLAM with Gated Recurrent State
- Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory
- Test-Time Training Done Right
- ZipMap: Linear-Time Stateful 3D Reconstruction via Test-Time Training
- LoGeR: Long-Context Geometric Reconstruction with Hybrid Memory
- Mem3R: Streaming 3D Reconstruction with Hybrid Memory via Test-Time Training
- VGG-T$^3$: Offline Feed-Forward 3D Reconstruction at Scale
- MASt3R-SLAM: Real-Time Dense SLAM with 3D Reconstruction Priors
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models