@misc{indiciae1026a455da8d, title = {Hybrid Reinforcement: When Reward Is Sparse, It's Better to Be Dense}, author = {Leitian Tao and Ilia Kulikov and Swarnadeep Saha and Tianlu Wang and Jing Xu and Sharon Li and Jason E Weston and Ping Yu}, year = {2025}, url = {https://arxiv.org/abs/2510.07242}, note = {Source identifier: 2510.07242} }