@misc{indiciae9a6c3f9da903, title = {BRAIn: Bayesian Reward-conditioned Amortized Inference for natural language generation from feedback}, author = {Gaurav Pandey and Yatin Nandwani and Tahira Naseem and Mayank Mishra and Guangxuan Xu and Dinesh Raghu and Sachindra Joshi and Asim Munawar and Ramón Fernandez Astudillo}, year = {2024}, url = {https://arxiv.org/abs/2402.02479}, note = {Source identifier: 2402.02479} }