TurnBench: A Multi-Domain Benchmark for Turn-Taking Dynamics in Spoken Dialogue
eess.AS, cs.CL
Submitted: 2026-08-25
Updated: 2026-09-16
Code: https://github.com/SesameAILabs/turnbench
Terminology
Sources
- Endpoint Anticipation for Low-Latency Spoken Dialogue
- Moshi: a speech-text foundation model for real-time dialogue
- Full-Duplex-Bench-v3: Benchmarking Tool Use for Full-Duplex Voice Agents Under Real-World Disfluency
- Talking Turns: Benchmarking Audio Foundation Models on Turn-Taking Dynamics
- ANCHOR: Autoregressive Non-intrusive Chunk-Ordered Refinement for Joint Multi-Resolution Speech Quality Modeling
Related papers
- X-VC: Zero-shot Streaming Voice Conversion in Codec Space
- Autoregressive Guidance of Deep Spatially Selective Filters using Bayesian Tracking for Efficient Extraction of Moving Speakers
- Anonymization, Not Elimination: Utility-Preserved Speech Anonymization
- Towards Audio Token Compression in Large Audio Language Models
- WaveScat: Wavelet Scattering Front-Ends with Self-Supervised Features for Speech Deepfake Detection
- ProPS: Prompted Profile Synthesis for Natural Language-Conditioned Speaker Embedding Distributions