Video-to-Music Generation for Gameplay Videos
cs.SD, cs.AI, cs.CV, cs.MM
Submitted: 2026-09-25
Updated: 2026-09-29
Project page: https://felipemarra.github.io/demo-v2m-4-gameplay-videos-v1
Terminology
Sources
- Fr'echet Audio Distance: A Metric for Evaluating Music Enhancement Algorithms
- High Fidelity Neural Audio Compression
- VidMusician: Video-to-Music Generation with Semantic-Rhythmic Alignment via Hierarchical Visual Features
- YouTube-8M: A Large-Scale Video Classification Benchmark
- VideoLLaMA 3: Frontier Multimodal Foundation Models for Image and Video Understanding
Related papers
- Few-Shot Open-Set Audio Classification via Transductive Prototype Refinement and Class Logit Enhancement
- Spectral Masking and Interpolation Attack (SMIA): A Black-box Adversarial Attack against Voice Authentication and Anti-Spoofing Systems
- AVMeme Exam: A Multimodal Multilingual Multicultural Benchmark for LLMs' Contextual and Cultural Knowledge and Thinking
- SoundWeaver: Compositional Warm-Starting for Text-to-Audio Diffusion Serving
- WASIL: In-the-Wild Arabic Spoken Interactions with LLMs
- Efficient Audiovisual Speech Processing via MUTUD: Multimodal Training and Unimodal Deployment