TY - RPRT TI - LEO-VL: Efficient Scene Representation for Scalable 3D Vision-Language Learning AU - Jiangyong Huang AU - Xiaojian Ma AU - Xiongkun Linghu AU - Junchao He AU - Qing Li AU - Song-Chun Zhu AU - Yixin Chen AU - Baoxiong Jia AU - Siyuan Huang PY - 2026 UR - https://arxiv.org/abs/2506.09935 ID - 2506.09935 ER -