Frozen Scenes, Shifting Winners: Configuration Fragility in Text-to-3D Evaluation
cs.AI, cs.CL, cs.CV, cs.GR, cs.MM
Submitted: 2026-09-30
Updated: 2026-09-30
Terminology
Sources
- A Cross-Model VLM-Judge Protocol for Single-Image 3D Mesh Quality (and Why Cheap Proxies Fall Short)
- HOLODECK 2.0: Vision-Language-Guided 3D World Generation with Editing
- Eval Factsheets: A Structured Framework for Documenting AI Evaluations
- Evaluation Cards: An Interpretive Layer for AI Evaluation Reporting
- T$^3$Bench: Benchmarking Current Progress in Text-to-3D Generation
- TDBench: A Benchmark for Top-Down Image Understanding with Reliability Analysis of Vision-Language Models
- SceneCritic: A Symbolic Evaluator for 3D Indoor Scene Synthesis
- EVA-CLIP: Improved Training Techniques for CLIP at Scale
- SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features
- 3DGen-Bench: Comprehensive Benchmark Suite for 3D Generative Models
- 3D-DefectBench: A Controlled Factorial Study of Vision-Language Model Evaluation Pipelines for Fine-Grained 3D Generation Defects
Related papers
- MAVEN-T: Reinforced Heterogeneous Distillation for Real-Time Multi-Agent Trajectory Prediction
- Model Discovery Agent: LLM-assisted Bayesian experiment design for data-efficient discovery of mechanistic world models
- The Clinician's Veto: Navigating Trust, Liability, and Uncertainty in Autonomous AI Prescribing
- MindHelper: Closed-Loop Embodied Mental-State Reasoning for Precision Intervention
- Incumbent Advantage: Brand Bias and Cognitive Manipulation Dynamics in LLM Recommendation Systems
- VSAL: A Vision Solver with Adaptive Layouts for Graph Property Detection