@misc{indiciae8cb9de67861a, title = {When LLM Reward Design Fails: Diagnostic-Driven Refinement for Sparse Structured RL}, author = {Youting Wang and Yuan Tang and Bowen Liu and Xuan Liu and Dingyan Shang}, year = {2026}, url = {https://arxiv.org/abs/2605.28918}, note = {Source identifier: 2605.28918} }