TY - RPRT TI - Data-Efficient Alignment of Large Language Models with Human Feedback Through Natural Language AU - Di Jin AU - Shikib Mehri AU - Devamanyu Hazarika AU - Aishwarya Padmakumar AU - Sungjin Lee AU - Yang Liu AU - Mahdi Namazifar PY - 2023 UR - https://arxiv.org/abs/2311.14543 ID - 2311.14543 ER -