@misc{indiciae0afbf2152537, title = {MM-Doc-R1: Training Agents for Long Document Visual Question Answering through Multi-turn Reinforcement Learning}, author = {Jiahang Lin and Kai Hu and Binghai Wang and Yuhao Zhou and Zhiheng Xi and Honglin Guo and Shichun Liu and Junzhe Wang and Shihan Dou and Enyu Zhou and Hang Yan and Zhenhua Han and Tao Gui and Qi Zhang and Xuanjing Huang}, year = {2026}, url = {https://arxiv.org/abs/2604.13579}, note = {Source identifier: 2604.13579} }