The Domain Is a Residue: Adapting Self-Supervised Features, Not Generators
cs.CV, cs.GR, cs.LG
Submitted: 2026-09-29
Updated: 2026-09-29
Project page: https://d3ixi.github.io/RepresentationFeatureAdapter/ABSTRACT
Terminology
Sources
- One Layer Is Enough: Adapting Pretrained Visual Encoders for Image Generation
- Multiplayer Interactive World Models with Representation Autoencoders
- AdapterTune: Zero-Initialized Low-Rank Adapters for Frozen Vision Transformers
- Unpaired Image-to-Image Translation via a Self-Supervised Semantic Bridge
- PiD: Fast and High-Resolution Latent Decoding with Pixel Diffusion
- Cyclone: Diffusion Model for Cycle-Consistent Weather Editing from Unpaired Driving Data
- Reconstruction or Semantics? What Makes a Latent Space Useful for Robotic World Models
- Cosmos-Transfer1: Conditional World Generation with Adaptive Multimodal Control
- X-Restormer++: 1st Place Solution for the UG2+ CVPR 2026 All-Weather Restoration Challenge
- One-Step Image Translation with Text-to-Image Models
- HyPER-GAN: Hybrid Patch-Based Image-to-Image Translation for Real-Time Photorealism Enhancement in Game Engines
- UNIT-DDPM: UNpaired Image Translation with Denoising Diffusion Probabilistic Models
- DINOv3
- Improved Baselines with Representation Autoencoders
- UVCGAN v2: An Improved Cycle-Consistent GAN for Unpaired Image-to-Image Translation
- PRISM: Distribution-Gated Flow Matching for Controllable Unpaired Image Translation
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models