Seg3DParts: Segmentation-Grounded Controllable Part-Level 3D Generation
cs.CV
Submitted: 2026-09-29
Updated: 2026-09-29
Terminology
Sources
- HoloPart: Generative 3D Part Amodal Segmentation
- X-Part: high fidelity and structure coherent shape decomposition
- AutoPartGen: Autogressive 3D Part Generation and Discovery
- PartGen: Part-level 3D Generation and Reconstruction with Multi-View Diffusion Models
- SAMPart3D: Segment Any Part in 3D Objects
- PartCrafter: Structured 3D Mesh Generation via Compositional Latent Diffusion Transformers
- From One to More: Contextual Part Latents for 3D Generation
- Efficient Part-level 3D Object Generation via Dual Volume Packing
- FullPart: Generating each 3D Part at Full Resolution
- Hunyuan3D 2.0: Scaling Diffusion Models for High Resolution Textured 3D Assets Generation
- Wonder3D: Single Image to 3D using Cross-Domain Diffusion
- UltraShape 1.0: High-Fidelity 3D Shape Generation via Scalable Geometric Refinement
- Direct3D-S2: Gigascale 3D Generation Made Easy with Spatial Sparse Attention
- Pandora3D: A Comprehensive Framework for High-Quality 3D Shape and Texture Generation
- TripoSG: High-Fidelity 3D Shape Synthesis using Large-Scale Rectified Flow Models
- Sparc3D: Sparse Representation and Construction for High-Resolution 3D Shapes Modeling
- MeshCoder: LLM-Powered Structured Mesh Code Generation from Point Clouds
- GeoSAM2: Unleashing the Power of SAM2 for 3D Part Segmentation
- MoCA: Mixture-of-Components Attention for Scalable Compositional 3D Generation
- OmniPart: Part-Aware 3D Generation with Semantic Decoupling and Structural Cohesion
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models