Reimagine Video Dynamics
cs.CV
Submitted: 2026-09-29
Updated: 2026-09-29
Project page: https://yuyuanspace.com/RVD
Terminology
Sources
- V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning
- Qwen3-VL Technical Report
- VINO: A Unified Visual Generator with Interleaved OmniModal Context
- Seedance 1.0: Exploring the Boundaries of Video Generation Models
- HunyuanVideo: A Systematic Framework For Large Video Generative Models
- V-JEPA 2.1: Unlocking Dense Features in Video Self-Supervised Learning
- Reconstruction or Semantics? What Makes a Latent Space Useful for Robotic World Models
- DINOv2: Learning Robust Visual Features without Supervision
- Wan: Open and Advanced Large-Scale Video Generative Models
- Qwen-Image Technical Report
- Omni-Video 2: Scaling MLLM-Conditioned Diffusion for Unified Video Generation and Editing
- CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer
- OptiWorld: Optimal Control for Video World Generation under Physical Constraints
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models