Rebalancing Reference Frame Dominance to Improve Motion in Image-to-Video Models
cs.CV, cs.AI
Submitted: 2026-05-19
Updated: 2026-09-25
Code: https://github.com/black-forest-labs/flux
Terminology
Sources
- Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow
- HunyuanVideo 1.5 Technical Report
- Wan: Open and Advanced Large-Scale Video Generative Models
- Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets
- Open-Sora Plan: Open-Source Large Video Generation Model
- Imagen Video: High Definition Video Generation with Diffusion Models
- LTX-Video: Realtime Video Latent Diffusion
- MAGI-1: Autoregressive Video Generation at Scale
- I2VGen-XL: High-Quality Image-to-Video Synthesis via Cascaded Diffusion Models
- FlashI2V: Fourier-Guided Latent Shifting Prevents Conditional Image Leakage in Image-to-Video Generation
- Improving Motion in Image-to-Video Models via Adaptive Low-Pass Guidance
- Auto-Encoding Variational Bayes
- Classifier-Free Diffusion Guidance
- MotionCFG: Boosting Motion Dynamics via Stochastic Concept Perturbation
- Memory-V2V: Memory-Augmented Video-to-Video Diffusion for Consistent Multi-Turn Editing
- Universal Image Immunization against Diffusion-based Image Editing via Semantic Injection
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models