TY - RPRT TI - Entropy Is Not Enough: Unlocking Effective Reinforcement Learning for Visual Reasoning via Vision-Anchored Token Selection AU - Senjie Jin AU - Peixin Wang AU - Boyang Liu AU - Xiaoran Fan AU - Shuo Li AU - Zhiheng Xi AU - Jiazheng Zhang AU - Yuhao Zhou AU - Tao Gui AU - Qi Zhang AU - Xuanjing Huang PY - 2026 UR - https://arxiv.org/abs/2606.03937 ID - 2606.03937 ER -