DecomVoxel: Harnessing 3D-Native Priors with Guided In-situ Denoising Optimization for Decompositional Scene Reconstruction
cs.CV
Submitted: 2026-10-01
Updated: 2026-10-01
Code: https://github.com/DecomVoxel/DecomVoxel
Terminology
Sources
- ReconViaGen: Towards Accurate Multi-view 3D Object Reconstruction via Generation
- SAM 3D: 3Dfy Anything in Images
- Advancing Structured Priors for Sparse-Voxel Surface Reconstruction
- LucidDreamer: Domain-free Generation of 3D Gaussian Splatting Scenes
- ReplicateAnyScene: Zero-Shot Video-to-3D Composition via Textual-Visual-Spatial Alignment
- LRM: Large Reconstruction Model for Single Image to 3D
- UniRecGen: Unifying Multi-View 3D Reconstruction and Generation
- Hunyuan3D 2.5: Towards High-Fidelity 3D Assets Generation with Ultimate Details
- MV-SAM3D: Adaptive Multi-View Fusion for Layout-Aware 3D Generation
- GeoSVR: Taming Sparse Voxels for Geometrically Accurate Surface Reconstruction
- VoxHammer: Training-Free Precise and Coherent 3D Editing in Native 3D Space
- PAC-NeRF: Physics Augmented Continuum Neural Radiance Fields for Geometry-Agnostic System Identification
- Depth Anything 3: Recovering the Visual Space from Any Views
- Flow Matching for Generative Modeling
- SceneGen: Single-Image 3D Scene Generation in One Feedforward Pass
- SVRecon: Sparse Voxel Rasterization for Surface Reconstruction
- DINOv2: Learning Robust Visual Features without Supervision
- Seedream 4.0: Toward Next-generation Multimodal Image Generation
- MVDream: Multi-view Diffusion for 3D Generation
- ShapeR: Robust Conditional 3D Shape Generation from Casual Captures
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models