TY - RPRT TI - Reading or Reasoning? Format Decoupled Reinforcement Learning for Document OCR AU - Yufeng Zhong AU - Lei Chen AU - Zhixiong Zeng AU - Xuanle Zhao AU - Deyang Jiang AU - Liming Zheng AU - Jing Huang AU - Haibo Qiu AU - Peng Shi AU - Siqi Yang AU - Lin Ma PY - 2025 UR - https://arxiv.org/abs/2601.08834 ID - 2601.08834 ER -