TY - RPRT TI - Vela: Scalable Embeddings with Voice Large Language Models for Multimodal Retrieval AU - Ruofan Hu AU - Yan Xia AU - Minjie Hong AU - Jieming Zhu AU - Bo Chen AU - Xiaoda Yang AU - Minghui Fang AU - Tao Jin PY - 2025 UR - https://arxiv.org/abs/2506.14445 ID - 2506.14445 ER -