DyMD: Preserving Interaction Dynamics through Distribution Matching Distillation in Few-Step Video World Models
cs.CV, cs.AI
Submitted: 2026-09-25
Updated: 2026-09-25
Terminology
Sources
- Optimizing Few-Step Generation with Adaptive Matching Distillation
- VideoJAM: Joint Appearance-Motion Representations for Enhanced Motion Generation in Video Models
- RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation
- ABot-PhysWorld: Interactive World Foundation Model for Robotic Manipulation with Physics Alignment
- Video Prediction Policy: A Generalist Robot Policy with Predictive Visual Representations
- Reinforcing Few-step Generators via Reward-Tilted Distribution Matching
- DreamGen: Unlocking Generalization in Robot Learning through Video World Models
- Distribution Matching Distillation Meets Reinforcement Learning
- HunyuanVideo: A Systematic Framework For Large Video Generative Models
- Flow Matching for Generative Modeling
- Reward Forcing: Efficient Streaming Video Generation with Rewarded Distribution Matching Distillation
- Latent Consistency Models: Synthesizing High-Resolution Images with Few-Step Inference
- V-JEPA 2.1: Unlocking Dense Features in Video Self-Supervised Learning
- Cosmos World Foundation Model Platform for Physical AI
- DINOv2: Learning Robust Visual Features without Supervision
- WorldArena: A Unified Benchmark for Evaluating Perception and Functional Utility of Embodied World Models
- Wan: Open and Advanced Large-Scale Video Generative Models
- Generative Video Compression with Adaptive Score Distillation
- PhysisForcing: Physics Reinforced World Simulator for Robotic Manipulation
- CoDMD: Copula-aware Distribution Matching Distillation for Fast Video Generation
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models