@misc{indiciaee01f853ea0c4, title = {Reinforcement Learning in hyperbolic space for multi-step reasoning}, author = {Tao Xu and Dung-Yang Lee and Momiao Xiong}, year = {2025}, url = {https://arxiv.org/abs/2507.16864}, note = {Source identifier: 2507.16864} }