TY - RPRT TI - Distillation-PPO: A Novel Two-Stage Reinforcement Learning Framework for Humanoid Robot Perceptive Locomotion AU - Qiang Zhang AU - Gang Han AU - Jingkai Sun AU - Wen Zhao AU - Chenghao Sun AU - Jiahang Cao AU - Jiaxu Wang AU - Yijie Guo AU - Renjing Xu PY - 2025 UR - https://arxiv.org/abs/2503.08299 ID - 2503.08299 ER -