SPOON: Towards Coherent Compositional 3D Scene Generation from Uncalibrated Multi-view Images
cs.CV
Submitted: 2026-09-30
Updated: 2026-09-30
Terminology
Sources
- ShapeNet: An Information-Rich 3D Model Repository
- Ultra3D: Efficient and High-Fidelity 3D Generation with Part Attention
- Geometry Image Diffusion: Fast and Data-Efficient Text-to-3D with Image-Based Surface Representation
- UniRecGen: Unifying Multi-View 3D Reconstruction and Generation
- MV-SAM3D: Adaptive Multi-View Fusion for Layout-Aware 3D Generation
- ShapeR: Robust Conditional 3D Shape Generation from Casual Captures
- Direct3D-S2: Gigascale 3D Generation Made Easy with Spatial Sparse Attention
- Native and Compact Structured Latents for 3D Generation
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models