WanPE: Towards Cinematic Prompt Enhancement for Modern Text-to-Video Generation
cs.CV
Submitted: 2026-09-24
Updated: 2026-09-24
Project page: https://wan-pe.github.io
Terminology
Sources
- PhyPrompt: RL-based Prompt Refinement for Physically Plausible Text-to-Video Generation
- CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation
- POS: A Prompts Optimization Suite for Augmenting Text-to-Video Generation
- RAPO++: Cross-Stage Prompt Optimization for Text-to-Video Generation via Data Alignment and Test-Time Scaling
- Wan: Open and Advanced Large-Scale Video Generative Models
- DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models
- Seedance 2.0: Advancing Video Generation for World Complexity
- Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets
- LAVIE: High-Quality Video Generation with Cascaded Latent Diffusion Models
- AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning
- Latte: Latent Diffusion Transformer for Video Generation
- Open-Sora: Democratizing Efficient Video Production for All
- CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer
- HunyuanVideo 1.5 Technical Report
- Scaling Mixture-of-Experts Video Pretraining for Embodied Intelligence
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models