@misc{indiciaeadc2f5d453ed, title = {Reinforcement Learning from Multi-role Debates as Feedback for Bias Mitigation in LLMs}, author = {Ruoxi Cheng and Haoxuan Ma and Shuirong Cao and Jiaqi Li and Aihua Pei and Zhiqiang Wang and Pengliang Ji and Haoyu Wang and Jiaqi Huo}, year = {2024}, url = {https://arxiv.org/abs/2404.10160}, note = {Source identifier: 2404.10160} }