TY - RPRT TI - FLoRA: Sample-Efficient Preference-based RL via Low-Rank Style Adaptation of Reward Functions AU - Daniel Marta AU - Simon Holk AU - Miguel Vasco AU - Jens Lundell AU - Timon Homberger AU - Finn Busch AU - Olov Andersson AU - Danica Kragic AU - Iolanda Leite PY - 2025 UR - https://arxiv.org/abs/2504.10002 ID - 2504.10002 ER -