@misc{indiciaef8affdbf1979, title = {Adaptive Reinforcement for Open-ended Medical Reasoning via Semantic-Guided Reward Collapse Mitigation}, author = {Yizhou Liu and Dingkang Yang and Zizhi Chen and Minghao Han and Xukun Zhang and Keliang Liu and Jingwei Wei and Lihua Zhang}, year = {2026}, url = {https://arxiv.org/abs/2508.12957}, note = {Source identifier: 2508.12957} }