@misc{indiciae8a901ff3beeb, title = {REBEL: Reward Regularization-Based Approach for Robotic Reinforcement Learning from Human Feedback}, author = {Souradip Chakraborty and Anukriti Singh and Amisha Bhaskar and Pratap Tokekar and Dinesh Manocha and Amrit Singh Bedi}, year = {2025}, url = {https://arxiv.org/abs/2312.14436}, note = {Source identifier: 2312.14436} }