TY - RPRT TI - DiagR1: A Vision-Language Model Trained via Reinforcement Learning for Digestive Pathology Diagnosis AU - Minxi Ouyang AU - Lianghui Zhu AU - Yaqing Bao AU - Qiang Huang AU - Jingli Ouyang AU - Tian Guan AU - Xitong Ling AU - Jiawen Li AU - Song Duan AU - Wenbin Dai AU - Li Zheng AU - Xuemei Zhang AU - Yonghong He PY - 2025 UR - https://arxiv.org/abs/2507.18433 ID - 2507.18433 ER -