TY - RPRT TI - Speech-to-See: End-to-End Speech-Driven Open-Set Object Detection AU - Wenhuan Lu AU - Xinyue Song AU - Wenjun Ke AU - Zhizhi Yu AU - Wenhao Yang AU - Jianguo Wei PY - 2025 UR - https://arxiv.org/abs/2509.16670 ID - 2509.16670 ER -