TY - RPRT TI - Emergent Hierarchical Reasoning in LLMs through Reinforcement Learning AU - Haozhe Wang AU - Qixin Xu AU - Che Liu AU - Junhong Wu AU - Fangzhen Lin AU - Wenhu Chen PY - 2025 UR - https://arxiv.org/abs/2509.03646 ID - 2509.03646 ER -