TY - RPRT TI - RLRF: Competitive Search Agent Design via Reinforcement Learning from Ranker Feedback AU - Tommy Mordo AU - Sagie Dekel AU - Omer Madmon AU - Moshe Tennenholtz AU - Oren Kurland PY - 2025 UR - https://arxiv.org/abs/2510.04096 ID - 2510.04096 ER -