TY - RPRT TI - Generalizing Preference-based Reinforcement Learning: a Rationality Model for Incomparability AU - Simone Drago AU - Marco Mussi AU - Leonardo Bianconi AU - Alberto Maria Metelli PY - 2026 UR - https://arxiv.org/abs/2607.11432 ID - 2607.11432 ER -