TY - RPRT TI - 4D-VLA: Spatiotemporal Vision-Language-Action Pretraining with Cross-Scene Calibration AU - Jiahui Zhang AU - Yurui Chen AU - Yueming Xu AU - Ze Huang AU - Yanpeng Zhou AU - Yu-Jie Yuan AU - Xinyue Cai AU - Guowei Huang AU - Xingyue Quan AU - Hang Xu AU - Li Zhang PY - 2025 UR - https://arxiv.org/abs/2506.22242 ID - 2506.22242 ER -