TY - RPRT TI - StructRL: Online Structured Reinforcement Learning for Long-Horizon Vision-Language-Action Tasks AU - Ziyi Yin AU - Sangmin Woo AU - Kang Zhou AU - Sungyeon Kim AU - Aosong Feng AU - Haibo Ding AU - Jun Huan PY - 2026 UR - https://arxiv.org/abs/2609.36352 ID - 2609.36352 ER -