TY - RPRT TI - Uncertainty Quantification for Large Language Model Reward Learning under Heterogeneous Human Feedback AU - Pangpang Liu AU - Junwei Lu AU - Will Wei Sun PY - 2025 UR - https://arxiv.org/abs/2512.03208 ID - 2512.03208 ER -