TY - RPRT TI - Toward Scientific Reasoning in LLMs: Training from Expert Discussions via Reinforcement Learning AU - Ming Yin AU - Yuanhao Qu AU - Ling Yang AU - Le Cong AU - Mengdi Wang PY - 2025 UR - https://arxiv.org/abs/2505.19501 ID - 2505.19501 ER -