@misc{indiciaecd296cce8c40, title = {Conditional Advantage Estimation for Reinforcement Learning in Large Reasoning Models}, author = {Guanxu Chen and Yafu Li and Yuxian Jiang and Chen Qian and Qihan Ren and Jingyi Yang and Yu Cheng and Dongrui Liu and Jing Shao}, year = {2025}, url = {https://arxiv.org/abs/2509.23962}, note = {Source identifier: 2509.23962} }