Beyond Spatial-Domain Supervision: A Relation Constrained Space for Multi-Modal Image Fusion
cs.CV
Submitted: 2026-09-30
Updated: 2026-09-30
Code: https://github.com/GMY628/RCS-Fusion
Terminology
Sources
- DINOv2: Learning Robust Visual Features without Supervision
- YOLOv12: Attention-Centric Real-Time Object Detectors
- Multi-Modal Image Fusion via Intervention-Stable Feature Learning
- Customized Fusion: A Closed-Loop Dynamic Network for Adaptive Multi-Task-Aware Infrared-Visible Image Fusion
- Image Fusion via Vision-Language Model
- DIDFuse: Deep Image Decomposition for Infrared and Visible Image Fusion
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models