@misc{indiciae22de2957be17, title = {Efficient Reinforcement Learning from Human Feedback via Bayesian Preference Inference}, author = {Matteo Cercola and Valeria Capretti and Simone Formentin}, year = {2025}, url = {https://arxiv.org/abs/2511.04286}, note = {Source identifier: 2511.04286} }