Seeing Speech: Learning Visible Articulatory Dynamics for Speech-Driven 3D Facial Animation
eess.AS, cs.GR, cs.LG
Submitted: 2026-09-24
Updated: 2026-09-24
Terminology
Sources
- Teaching Machines to Speak Using Articulatory Control
- Ex-Omni: Enabling 3D Facial Animation Generation for Omni-modal Large Language Models
- EmoFace: Emotion-Content Disentangled Speech-Driven 3D Talking Face Animation
- EditEmoTalk: Controllable Speech-Driven 3D Facial Animation with Continuous Expression Editing
Related papers
- X-VC: Zero-shot Streaming Voice Conversion in Codec Space
- Autoregressive Guidance of Deep Spatially Selective Filters using Bayesian Tracking for Efficient Extraction of Moving Speakers
- Anonymization, Not Elimination: Utility-Preserved Speech Anonymization
- Towards Audio Token Compression in Large Audio Language Models
- WaveScat: Wavelet Scattering Front-Ends with Self-Supervised Features for Speech Deepfake Detection
- ProPS: Prompted Profile Synthesis for Natural Language-Conditioned Speaker Embedding Distributions