Sparse auto-regressive modeling for scene generation from multi-view images
cs.CV, cs.LG
Submitted: 2026-09-03
Updated: 2026-09-03
Terminology
Sources
- Layer Normalization
- Lyra: Generative 3D Scene Reconstruction via Video Diffusion Model Self-Distillation
- SceneCompleter: Dense 3D Scene Completion for Generative Novel View Synthesis
- Sampling 3D Gaussian Scenes in Seconds with Latent Diffusion Models
- GaussianDiffusion: 3D Gaussian Splatting for Denoising Diffusion Probabilistic Models with Structured Noise
- Complete Gaussian Splats from a Single Image with Denoising Diffusion Models
- Zero-1-to-G: Taming Pretrained 2D Diffusion Model for Direct 3D Generation
- RoFormer: Enhanced Transformer with Rotary Position Embedding
- ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models