TY - RPRT TI - RA-PbRL: Provably Efficient Risk-Aware Preference-Based Reinforcement Learning AU - Yujie Zhao AU - Jose Efraim Aguilar Escamill AU - Weyl Lu AU - Huazheng Wang PY - 2025 UR - https://arxiv.org/abs/2410.23569 ID - 2410.23569 ER -