TY - RPRT TI - Reliable Use of Lemmas via Eligibility Reasoning and Section$-$Aware Reinforcement Learning AU - Zhikun Xu AU - Xiaodong Yu AU - Ben Zhou AU - Jiang Liu AU - Jialian Wu AU - Ze Wang AU - Ximeng Sun AU - Hao Chen AU - Zicheng Liu PY - 2026 UR - https://arxiv.org/abs/2602.00998 ID - 2602.00998 ER -