@misc{indiciae63e4db672138, title = {SAIL-RL: Guiding MLLMs in When and How to Think via Dual-Reward RL Tuning}, author = {Fangxun Shu and Yongjie Ye and Yue Liao and Zijian Kang and Weijie Yin and Jiacong Wang and Xiao Liang and Shuicheng Yan and Chao Feng}, year = {2026}, url = {https://arxiv.org/abs/2511.02280}, note = {Source identifier: 2511.02280} }