TY - RPRT TI - Optimizing RAG Rerankers with LLM Feedback via Reinforcement Learning AU - Yuhang Wu AU - Xiangqing Shen AU - Fanfan Wang AU - Cangqi Zhou AU - Zhen Wu AU - Xinyu Dai AU - Rui Xia PY - 2026 UR - https://arxiv.org/abs/2604.02091 ID - 2604.02091 ER -