LongLive-Plug: Once-for-All Distillation for Video Generation
cs.CV
Submitted: 2026-09-29
Updated: 2026-09-29
Terminology
Sources
- Motus: A Unified Latent Action World Model
- BWM: A Low-Cost High-Fidelity World Simulator for Robot Learning
- H3-World: Turning Language Understanding into World Control
- HunyuanVideo-Avatar: High-Fidelity Audio-Driven Human Animation for Multiple Characters
- Code World Model: Coding Agent as World Brain
- ABot-PhysWorld: Interactive World Foundation Model for Robotic Manipulation with Physics Alignment
- From Draft to Draft-Free: One-Step Video Object Removal via Privileged Distillation and Fast Planting
- Wan-Move: Motion-controllable Video Generation via Latent Trajectory Guidance
- UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining
- FantasyWorld: Geometry-Consistent World Modeling via Unified Video and 3D Prediction
- MAGREF: Masked Guidance for Any-Reference Video Generation with Subject Disentanglement
- Video Generation with Stable Transparency via Shiftable RGB-A Distribution Learner
- DreamX-World 1.0: A General-Purpose Interactive World Model
- VideoGPA: Distilling Geometry Priors for 3D-Consistent Video Generation
- LongVie 2: Multimodal Controllable Ultra-Long Video World Model
- DreamDojo: A Generalist Robot World Model from Large-Scale Human Videos
- LTX-Video: Realtime Video Latent Diffusion
- Classifier-Free Diffusion Guidance
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models