TY - RPRT TI - Aligning Large Language Models from Self-Reference AI Feedback with one General Principle AU - Rong Bao AU - Rui Zheng AU - Shihan Dou AU - Xiao Wang AU - Enyu Zhou AU - Bo Wang AU - Qi Zhang AU - Liang Ding AU - Dacheng Tao PY - 2024 UR - https://arxiv.org/abs/2406.11190 ID - 2406.11190 ER -