TY - RPRT TI - REFINE-AF: A Task-Agnostic Framework to Align Language Models via Self-Generated Instructions using Reinforcement Learning from Automated Feedback AU - Aniruddha Roy AU - Pretam Ray AU - Abhilash Nandy AU - Somak Aditya AU - Pawan Goyal PY - 2025 UR - https://arxiv.org/abs/2505.06548 ID - 2505.06548 ER -