TY - RPRT TI - Trust, Don't Trust, or Flip: Robust Preference-Based Reinforcement Learning with Multi-Expert Feedback AU - Seyed Amir Hosseini AU - Maryam Abdolali AU - Amirhosein Tavakkoli AU - Fardin Ayar AU - Ehsan Javanmardi AU - Manabu Tsukada AU - Mahdi Javanmardi PY - 2026 UR - https://arxiv.org/abs/2601.18751 ID - 2601.18751 ER -