TY - RPRT TI - Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning AU - Bowen Jin AU - Hansi Zeng AU - Zhenrui Yue AU - Jinsung Yoon AU - Sercan Arik AU - Dong Wang AU - Hamed Zamani AU - Jiawei Han PY - 2025 UR - https://arxiv.org/abs/2503.09516 ID - 2503.09516 ER -