When the Judge Acts: Auditing VLM-Guided Image Selection on Culturally Situated Prompts
cs.CV, cs.AI, cs.CY
Submitted: 2026-10-01
Updated: 2026-10-01
Code: https://github.com/seochan99/JudgeActs
Terminology
Sources
- Judging to Improve: A De-biased VLM-as-3D-Judge Protocol for Single-Image 3D Generation
- JudgeSense: A Benchmark for Prompt Sensitivity in LLM-as-a-Judge Systems
- Debiasing Text-to-Image Evaluation via Implicit Cultural Alignment Reward Modeling
- Fooling the LVLM Judges: Visual Biases in LVLM-Based Evaluation
- SmolVLM: Redefining small and efficient multimodal models
- HalDec-Bench: Benchmarking Hallucination Detector in Image Captioning
- Exposing Blindspots: Cultural Bias Evaluation in Generative Image Models
- Toward Trustworthy Portrait Editing: Evaluation of Demographic Misrepresentation in I2I Models
- Prompt Revision as a Source of Cultural Bias in Text-to-Image Systems
- BAS: A Decision-Theoretic Approach to Evaluating Large Language Model Confidence
- Multimodal Reward Hacking in Reinforcement Learning
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models