TY - RPRT TI - Integrating Physician Diagnostic Logic into Large Language Models: Preference Learning from Process Feedback AU - Chengfeng Dou AU - Zhi Jin AU - Wenpin Jiao AU - Haiyan Zhao AU - Yongqiang Zhao AU - Zhenwei Tao PY - 2024 UR - https://arxiv.org/abs/2401.05695 ID - 2401.05695 ER -