KABURI-TTS: Phoneme-Keyed Activity-conditioned Bi-channel Utterance Rendering for Interaction

arXiv:2609.07200 · cs.SD, cs.CL · Submitted 2026-09-07 · Read on arXiv

cs.SD, cs.CL

Submitted: 2026-09-07

Updated: 2026-09-07

Comments: Accepted at APSIPA ASC 2026

License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/

Related papers