TY - RPRT TI - PrefMMT: Modeling Human Preferences in Preference-based Reinforcement Learning with Multimodal Transformers AU - Dezhong Zhao AU - Ruiqi Wang AU - Dayoon Suh AU - Taehyeon Kim AU - Ziqin Yuan AU - Byung-Cheol Min AU - Guohua Chen PY - 2025 UR - https://arxiv.org/abs/2409.13683 ID - 2409.13683 ER -