TY - RPRT TI - SEM: Reinforcement Learning for Search-Efficient Large Language Models AU - Zeyang Sha AU - Shiwen Cui AU - Weiqiang Wang PY - 2025 UR - https://arxiv.org/abs/2505.07903 ID - 2505.07903 ER -