TY - RPRT TI - XR-1: Towards Versatile Vision-Language-Action Models via Learning Unified Vision-Motion Representations AU - Shichao Fan AU - Kun Wu AU - Zhengping Che AU - Xinhua Wang AU - Di Wu AU - Fei Liao AU - Ning Liu AU - Yixue Zhang AU - Zhen Zhao AU - Zhiyuan Xu AU - Meng Li AU - Qingjie Liu AU - Shanghang Zhang AU - Min Wan AU - Jian Tang PY - 2026 UR - https://arxiv.org/abs/2511.02776 ID - 2511.02776 ER -