TY - RPRT TI - Proprioception Enhances Vision Language Model in Generating Captions and Subtask Segmentations for Robot Task AU - Kanata Suzuki AU - Shota Shimizu AU - Tetsuya Ogata PY - 2026 UR - https://arxiv.org/abs/2512.20876 ID - 2512.20876 ER -