TY - RPRT TI - How do Multimodal Foundation Models Encode Text and Speech? An Analysis of Cross-Lingual and Cross-Modal Representations AU - Hyunji Lee AU - Danni Liu AU - Supriti Sinhamahapatra AU - Jan Niehues PY - 2025 UR - https://arxiv.org/abs/2411.17666 ID - 2411.17666 ER -