@misc{indiciae4b751257a4c4, title = {RLCD: Reinforcement Learning from Contrastive Distillation for Language Model Alignment}, author = {Kevin Yang and Dan Klein and Asli Celikyilmaz and Nanyun Peng and Yuandong Tian}, year = {2024}, url = {https://arxiv.org/abs/2307.12950}, note = {Source identifier: 2307.12950} }