SoL-Refiner: Speed-of-Light One-Step Refinement for High-Resolution Video
cs.CV
Submitted: 2026-09-29
Updated: 2026-09-29
Project page: https://nvlabs.github.io/Sana/Sol-Engine/H3-Super-Acceleration
Terminology
Sources
- Imagen Video: High Definition Video Generation with Diffusion Models
- Seedance 1.0: Exploring the Boundaries of Video Generation Models
- HunyuanVideo: A Systematic Framework For Large Video Generative Models
- Wan: Open and Advanced Large-Scale Video Generative Models
- MobileWan: Closing the Quality Gap for Mobile Video Diffusion
- LTX-2: Efficient Joint Audio-Visual Foundation Model
- MarDini: Masked Autoregressive Diffusion for Video Generation at Scale
- SANA-WM: Efficient Minute-Scale World Modeling with Hybrid Linear Diffusion Transformer
- Scaling Mixture-of-Experts Video Pretraining for Embodied Intelligence
- Sol Video Inference Engine: Agent-Native Full-Stack Acceleration Framework for Efficient Video Generation
- VEnhancer: Generative Space-Time Enhancement for Video Generation
- Ultra Flash: Scaling Real-Time Streaming Video Generation to High Resolutions
- Upscale-A-Video: Temporal-Consistent Diffusion Model for Real-World Video Super-Resolution
- SeedVR: Seeding Infinity in Diffusion Transformer Towards Generic Video Restoration
- DOVE: Efficient One-Step Diffusion Model for Real-World Video Super-Resolution
- UltraVSR: Achieving Ultra-Realistic Video Super-Resolution with Efficient One-Step Diffusion Space
- SeedVR2: One-Step Video Restoration via Diffusion Adversarial Post-Training
- FlashVSR: Towards Real-Time Diffusion-Based Streaming Video Super-Resolution
- Improved Distribution Matching Distillation for Fast Image Synthesis
- SF-V: Single Forward Video Generation Model
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models