Taming Modality Entanglement in Continual Audio-Visual Segmentation
cs.MM, cs.AI, cs.CV
Submitted: 2025-10-20
Updated: 2026-09-01
Terminology
Sources
Related papers
- ControlFoley: Unified and Controllable Video-to-Audio Generation with Cross-Modal Conflict Handling
- Zero-shot Video Moment Retrieval via Off-the-shelf Multimodal Large Language Models
- Mitigating GenAI-powered Evidence Pollution for Out-of-Context Multimodal Misinformation Detection
- A Rate-Distortion-Classification Approach for Lossy Image Compression