TY - RPRT TI - SIGHT: Reinforcement Learning with Self-Evidence and Information-Gain Diverse Branching for Search Agent AU - Wenlin Zhong AU - Jinluan Yang AU - Yiquan Wu AU - Yi Liu AU - Jianhang Yao AU - Kun Kuang PY - 2026 UR - https://arxiv.org/abs/2602.11551 ID - 2602.11551 ER -