TY - RPRT TI - VoiceTextBlender: Augmenting Large Language Models with Speech Capabilities via Single-Stage Joint Speech-Text Supervised Fine-Tuning AU - Yifan Peng AU - Krishna C. Puvvada AU - Zhehuai Chen AU - Piotr Zelasko AU - He Huang AU - Kunal Dhawan AU - Ke Hu AU - Shinji Watanabe AU - Jagadeesh Balam AU - Boris Ginsburg PY - 2025 UR - https://arxiv.org/abs/2410.17485 ID - 2410.17485 ER -