Trustworthy synthetic visual media: Evidence across the media lifecycle
cs.CV
Submitted: 2026-09-28
Updated: 2026-09-28
Terminology
Sources
- Secure and Robust Watermarking for AI-generated Images: A Comprehensive Survey
- Methods and Trends in Detecting AI-Generated Images: A Comprehensive Review
- GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models
- SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis
- Hierarchical Text-Conditional Image Generation with CLIP Latents
- Qwen-Image Technical Report
- WaveNet: A Generative Model for Raw Audio
- Jukebox: A Generative Model for Music
- AudioGen: Textually Guided Audio Generation
- MusicLM: Generating Music From Text
- AudioLDM: Text-to-Audio Generation with Latent Diffusion Models
- Imagen Video: High Definition Video Generation with Diffusion Models
- Make-A-Video: Text-to-Video Generation without Text-Video Data
- Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets
- Movie Gen: A Cast of Media Foundation Models
- HunyuanVideo: A Systematic Framework For Large Video Generative Models
- Seedance 1.0: Exploring the Boundaries of Video Generation Models
- World Models
- DreamFusion: Text-to-3D using 2D Diffusion
- Point-E: A System for Generating 3D Point Clouds from Complex Prompts
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models