TY - RPRT TI - SpeechCT-CLIP: Distilling Text-Image Knowledge to Speech for Voice-Native Multimodal CT Analysis AU - Lukas Buess AU - Jan Geier AU - David Bani-Harouni AU - Chantal Pellegrini AU - Matthias Keicher AU - Paula Andrea Perez-Toro AU - Nassir Navab AU - Andreas Maier AU - Tomas Arias-Vergara PY - 2025 UR - https://arxiv.org/abs/2510.02322 ID - 2510.02322 ER -