TY - RPRT TI - MM-Doc-R1: Training Agents for Long Document Visual Question Answering through Multi-turn Reinforcement Learning AU - Jiahang Lin AU - Kai Hu AU - Binghai Wang AU - Yuhao Zhou AU - Zhiheng Xi AU - Honglin Guo AU - Shichun Liu AU - Junzhe Wang AU - Shihan Dou AU - Enyu Zhou AU - Hang Yan AU - Zhenhua Han AU - Tao Gui AU - Qi Zhang AU - Xuanjing Huang PY - 2026 UR - https://arxiv.org/abs/2604.13579 ID - 2604.13579 ER -