SWT: Self-Supervised Video Object Segmentation via Sliding, Wavelet and Transportation
cs.CV, cs.AI
Submitted: 2026-09-22
Updated: 2026-09-22
Code: https://github.com/machine928/SWT
Terminology
Sources
- Segment and Track Anything
- Dynamic in Static: Hybrid Visual Correspondence for Self-Supervised Video Object Segmentation
- The 2017 DAVIS Challenge on Video Object Segmentation
- Uni-ViGU: Towards Unified Video Generation and Understanding via A Diffusion-Based Video Generator
- Uni-cot: Towards Unified Chain-of-Thought Reasoning Across Text and Vision
- SoulX-FlashTalk: Real-Time Infinite Streaming of Audio-Driven Avatars via Self-Correcting Bidirectional Distillation
- Self-Supervised Learning with Swin Transformers
- SoulX-FlashHead: Oracle-guided Generation of Infinite Real-time Streaming Talking Heads
- MuseTalk: Real-Time High-Fidelity Video Dubbing via Spatio-Temporal Sampling
- AnyTalker: Scaling Multi-Person Talking Video Generation with Interactivity Refinement
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models