MooD: Perception-Enhanced Efficient Affective Image Editing via Continuous Valence-Arousal Modeling
cs.CV
Submitted: 2026-05-04
Updated: 2026-09-26
Terminology
Sources
- Improving Multimodal Sentiment Analysis via Modality Optimization and Dynamic Primary Modality Selection
- EmoKGEdit: Training-free Affective Injection via Visual Cue Transformation
- ViC-Bench: Benchmarking Visual-Interleaved Chain-of-Thought Capability in MLLMs with Free-Style Intermediate State Representations
- Qwen2.5-VL Technical Report
- eMotions: A Large-Scale Dataset and Audio-Visual Fusion Network for Emotion Analysis in Short-form Videos
- SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations
- Step1X-Edit: A Practical Framework for General Image Editing
- Decoupled Weight Decay Regularization
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models