TY - RPRT TI - Reinforcement Learning with Anticipation: A Hierarchical Approach for Long-Horizon Tasks AU - Yang Yu PY - 2025 UR - https://arxiv.org/abs/2509.05545 ID - 2509.05545 ER -