@misc{indiciae4c87c88c187f, title = {Learning from Unreachable Rewards: Hint-Conditioned Reinforcement Learning for Generative Recommendation}, author = {Kangning Zhang and Haotian Fang and Xukun Luo and Hao Yin and Yang Gao and Peng Yan and Weiwen Liu and Weinan Zhang and Yong Yu}, year = {2026}, doi = {10.1145/3799682.3840842}, url = {https://arxiv.org/abs/2608.11980}, note = {Source identifier: 2608.11980} }